Перейти к содержимому

Gen AI Update 2026: что изменилось на фронтире — и почему вы этого не чувствуете

Bayram Annakov

0:00 / 0:00

Gen AI Update 2026: что изменилось на фронтире — и почему вы этого не чувствуете

857 просмотров · 5 дней назад
Bayram Annakov
26,4 тыс. подписчиков
857 просмотров · 5 дней назад
🎯 Четыре месяца назад Байрам предсказал, что скорость удвоения возможностей AI ускорится. Сегодня — апдейт: бенчмарк, по которому это измеряли, сломался. Модели стали слишком умны для линейки, которой их мерили. Что произошло за 4 месяца — и почему вы это почти не чувствуете на своей компании. Что внутри: — Reward hacking: почему публичным бенчмаркам больше нельзя доверять и что делать вместо них — Инцидент OpenAI × HuggingFace: агент сбежал из изолированной среды, скоординировался с другими агентами, вышел в интернет и взламывал HuggingFace больше месяца — пока это заметили — Генералист с AI бьёт специалиста: исследование Anthropic — три PhD без узкой специализации выигрывают у трёх PhD-экспертов с моделью — Self-improvement: агенты начинают улучшать сами себя — где сейчас граница и что это значит для нас — Диссонанс: средняя компания тратит $12 в месяц на AI на сотрудника, топ 1% — $7400. Разница в 600 раз — и почему это объясняет всё — Кейс Glean: CEO навайбкодил за 2 дня то, что команда делала 9 месяцев. Что пошло не так дальше — Harness важнее модели: почему правильная обвязка даёт в 8 раз больше разницы, чем выбор модели — AI security trifecta: три условия, при которых ваш агент становится опасным — и как это балансировать — Приватные эвалы: почему нужна своя система оценки моделей и как её построить — Политика и fallback: что делать, если ваш основной AI-провайдер внезапно стал недоступен В этом видео: 00:00 Введение 01:21 Одно слово про эти 4 месяца — диссонанс 05:05 Акт 1: фронтир, там все быстро 18:15 Математика решается — что это значит 20:47 Генералист с AI бьёт специалиста 25:19 Self-improvement: агенты улучшают сами себя 30:16 Инцидент: агент сбежал из песочницы 42:21 Что смогли делать сейчас, что не могли 4 месяца назад 46:06 Акт 2: Harness важнее модели 56:56 Решение: нужны приватные эвалы 01:00:16 Акт 3: Почему мы этого не чувствуем 01:00:46 Данные: 61% используют AI, рост 52 минуты в неделю 01:04:42 $12 vs $7400 — разрыв в 600 раз 01:11:19 Как найти узкое место в процессе 01:23:55 Что делать практически 01:34:36 AI security trifecta: три опасных условия 01:38:20 Что может сделать ваш агент без проверки 01:41:26 Политика и fallback-план 01:43:11 Статистика: джуниоры под давлением 01:44:49 Резюме: 5 практических выводов 📚 Полезные ссылки: → Регистрация на курс AI Product Analyst (старт 16 августа) https://empatika.com/courses/ai-produ... → Бесплатные материалы по AI и автоматизации https://empatika.com/learn → Telegram-сообщество про продукты, стартапы и AI https://t.me/ProductsAndStartups #GenAI #AIагенты #AINative #Empatika #БайрамАннаков