Безопасность OpenAI: контролировать модели теперь — «настоящий ад»
AI Explained
0:00 / 0:00
Безопасность OpenAI: контролировать модели теперь — «настоящий ад»
180 634 просмотра · 1 день назад
AI Explained
453 тыс. подписчиков
180 634 просмотра · 1 день назад
Это видео сложно кратко описать. Взломанный шифр, предупреждение OpenAI о безопасности, Gemini 4 Argon, статья RSI (в соавторстве с ведущими специалистами в области ИИ), обязательства лаборатории Белого дома, появление новых взломов, «глубокие персоны», биологическое соревнование Каспарова и многое другое, завершающееся эпическим финалом Opus.
Эксклюзивы Patreon: / aiexplained
Главы:
00:00 - Введение
01:32 - Ошибки в отношении Opus 5.5? Расшифровка текста XVI века
05:01 - Почему модели постоянно вырываются из колеи
11:40 - Что модели нам не говорят
15:36 - Gemini 4 и гонка за релизом
19:19 - Что происходит, когда ИИ улучшает ИИ?
28:31 - Биология, сознание и то, что мы до сих пор не понимаем
Джо Дарроу: Не просто песочница: https://x.com/joedaroo/status/2104335...
Карточка Солнечной системы GPT-6.1: https://cdn.openai.com/pdf/38e3efcf-5...
Статья о взрыве интеллекта: https://casp.ac/__l5e/assets-v1/5efd4...
Ускорение исследований OpenAI: https://openai.com/index/research-acc...
Обоснование безопасности обучения OpenAI: https://openai.com/index/towards-safe...
Шифр Екатерины Медичи: https://cryptiana.web.fc2.com/code/he...
Предложенный расшифровщик Дю Крока: https://claude.ai/artifact/1W7B3WxkTA...
Расследование деятельности агентов-мошенников: https://asymmetricsecurity.com/newsro...
OpenAI откладывает выпуск GPT-6.1 Astra: https://www.reuters.com/business/open...
Аргументы в пользу прозрачности рассуждений: https://institute.deepmind.com/essays...
Gemini 4 Argon: https://blog.google/innovation-and-ai...
Соперничество OpenAI и антропогенных факторов: https://www.theatlantic.com/technolog...
NYT: Предупреждения OpenAI о безопасности: https://www.nytimes.com/2026/09/29/te...
NYT: Мораль Клода: https://www.nytimes.com/2026/09/29/us...
Жасмин Ван о синдроме запястного канала: https://x.com/j_asminewang/status/209...
Обзор уходов из OpenAI: https://x.com/Bayesian0_0/status/2105...
Обязательства Белого дома в области ИИ: https://x.com/Danmar_here/status/2105...
Сара Хек о безопасности: https://x.com/SarahKHeck/status/21050...
Сэм Альтман о выравнивании: https://x.com/tbpn/status/21050289928...
Сэм Альтман о журналах агентов: https://x.com/sama/status/21035671986...
Мика Кэрролл: Отчеты о несовпадениях: https://x.com/MicahCarroll/status/210...
Цзусинь Лю об инциденте: https://x.com/LiuZuxin/status/2103699...
Дипа Ситараман: Изображения пользователей: https://x.com/dseetharaman/status/210...
График доходов OpenAI: https://x.com/PaulBonnet/status/21052...
Платформа Nvidia Agent Safety: https://edition.cnn.com/2026/09/28/bu...
IntegrityBench: https://integrity-bench.com
Нил Нанда об интерпретируемости: https://x.com/PalisadeAI/status/21049...
Биологический конкурс: Люди и ИИ: https://www.theinformation.com/articl...
Пушмит Коли: SynthID Bio: https://x.com/pushmeet/status/2105314...
Атараксос и Стратего: https://x.com/ssokota/status/21053620...
Безопасные данные и скрытые личности: https://x.com/OwainEvans_UK/status/19...
Антропический: Интроспекция: https://www.anthropic.com/research/in...
Результаты мошенничества Клода: https://x.com/lukaspet/status/2104634...
Roon о математике и теории обучения: https://x.com/tszzl/status/2105619006...
Исследование GPT-4: https://openai.com/index/gpt-4-research/
И.Дж. Хорошо: Сверхинтеллектуальная машина: https://incompleteideas.net/papers/Go...
Интервью Теренса Тао 2024 года: https://www.scientificamerican.com/ar...
Инцидент с обнимающим лицом: https://openai.com/index/hugging-face...
Музыкальное видео Клода и Суно: https://x.com/sevdeawesome/status/210...
Подкаст: https://aiexplainedopodcast.buzzsprou...