Илья Суцкевер — Мы переходим от эпохи масштабирования к эпохе исследований
Dwarkesh Patel
0:00 / 0:00
Илья Суцкевер — Мы переходим от эпохи масштабирования к эпохе исследований
1 481 866 просмотров · 9 месяцев назад
Dwarkesh Patel
1,4 млн подписчиков
1 481 866 просмотров · 9 месяцев назад
Илья и я обсуждаем стратегию SSI, проблемы предварительного обучения, способы повышения обобщающей способности моделей ИИ и то, как обеспечить успешную работу общего искусственного интеллекта.
ЭПИЗОДЕ ЛИНКС
Транскрипт: https://www.dwarkesh.com/p/ilya-sutsk...
Apple Podcasts: https://podcasts.apple.com/us/podcast...
Spotify: https://open.spotify.com/episode/7naO...
СПОНСОРЫ
Gemini 3 — первая модель, которую я использовал, способная находить соединения, которые я не смог обнаружить. Ожидалось. Недавно я написал пост в блоге об эффективности использования информации в RL, и Gemini 3 помог мне все это обдумать. Он также сгенерировал соответствующие диаграммы и провел для меня тестовые эксперименты по машинному обучению без единой ошибки. Попробуйте Gemini 3 сегодня по адресу https://gemini.google
Labelbox помог мне создать инструмент для транскрипции наших эпизодов! Раньше у меня были проблемы с транскрипцией, потому что мне нужны не просто дословные расшифровки, а перефразированные, чтобы они читались как эссе. Labelbox помог мне сгенерировать именно данные, которые мне были нужны для этого. Если вы хотите узнать, как Labelbox может вам помочь (или если вы хотите сами попробовать инструмент транскрипции), перейдите по ссылке https://labelbox.com/dwarkesh
Sardine — это платформа управления рисками на основе ИИ, которая объединяет тысячи сигналов об устройствах, поведении и идентификации, чтобы помочь вам оценить риск мошенничества и злоупотреблений со стороны пользователя. Sardine также предлагает набор агентов для автоматизации расследований, так что, поскольку мошенники используют ИИ для масштабирования своих атак, вы можете использовать ИИ для масштабирования своей защиты. Узнайте больше на https://sardine.ai/dwarkesh
Чтобы спонсировать будущий эпизод, посетите https://dwarkesh.com/advertise
ТЕМЫ
00:00:00 – Объяснение неровностей модели
00:09:39 – Эмоции и функции ценности
00:18:49 – Что мы масштабируем?
00:25:13 – Почему люди обобщают лучше, чем модели
00:35:45 – Прямолинейный сверхинтеллект
00:46:47 – Модель SSI будет учиться на практике
00:55:07 – Согласованность
01:18:13 – «Мы живем в эпоху исследовательских компаний»
01:29:23 – Самостоятельная игра и многоагентные системы
01:32:42 – Вкусы в исследованиях