Gen AI Update 2026: что изменилось на фронтире — и почему вы этого не чувствуете
Bayram Annakov
0:00 / 0:00
Gen AI Update 2026: что изменилось на фронтире — и почему вы этого не чувствуете
857 просмотров · 5 дней назад
Bayram Annakov
26,4 тыс. подписчиков
857 просмотров · 5 дней назад
🎯 Четыре месяца назад Байрам предсказал, что скорость удвоения возможностей AI ускорится. Сегодня — апдейт: бенчмарк, по которому это измеряли, сломался. Модели стали слишком умны для линейки, которой их мерили.
Что произошло за 4 месяца — и почему вы это почти не чувствуете
на своей компании.
Что внутри:
— Reward hacking: почему публичным бенчмаркам больше нельзя доверять и что делать вместо них
— Инцидент OpenAI × HuggingFace: агент сбежал из изолированной среды, скоординировался с другими агентами, вышел в интернет и взламывал HuggingFace больше месяца — пока это заметили
— Генералист с AI бьёт специалиста: исследование Anthropic — три PhD без узкой специализации выигрывают у трёх PhD-экспертов с моделью
— Self-improvement: агенты начинают улучшать сами себя — где сейчас граница и что это значит для нас
— Диссонанс: средняя компания тратит $12 в месяц на AI на сотрудника, топ 1% — $7400. Разница в 600 раз — и почему это объясняет всё
— Кейс Glean: CEO навайбкодил за 2 дня то, что команда делала 9 месяцев. Что пошло не так дальше
— Harness важнее модели: почему правильная обвязка даёт в 8 раз больше разницы, чем выбор модели
— AI security trifecta: три условия, при которых ваш агент становится опасным — и как это балансировать
— Приватные эвалы: почему нужна своя система оценки моделей и как её построить
— Политика и fallback: что делать, если ваш основной AI-провайдер внезапно стал недоступен
В этом видео:
00:00 Введение
01:21 Одно слово про эти 4 месяца — диссонанс
05:05 Акт 1: фронтир, там все быстро
18:15 Математика решается — что это значит
20:47 Генералист с AI бьёт специалиста
25:19 Self-improvement: агенты улучшают сами себя
30:16 Инцидент: агент сбежал из песочницы
42:21 Что смогли делать сейчас, что не могли 4 месяца назад
46:06 Акт 2: Harness важнее модели
56:56 Решение: нужны приватные эвалы
01:00:16 Акт 3: Почему мы этого не чувствуем
01:00:46 Данные: 61% используют AI, рост 52 минуты в неделю
01:04:42 $12 vs $7400 — разрыв в 600 раз
01:11:19 Как найти узкое место в процессе
01:23:55 Что делать практически
01:34:36 AI security trifecta: три опасных условия
01:38:20 Что может сделать ваш агент без проверки
01:41:26 Политика и fallback-план
01:43:11 Статистика: джуниоры под давлением
01:44:49 Резюме: 5 практических выводов
📚 Полезные ссылки:
→ Регистрация на курс AI Product Analyst (старт 16 августа) https://empatika.com/courses/ai-produ...
→ Бесплатные материалы по AI и автоматизации
https://empatika.com/learn
→ Telegram-сообщество про продукты, стартапы и AI
https://t.me/ProductsAndStartups
#GenAI #AIагенты #AINative #Empatika #БайрамАннаков