Перейти к содержимому

Безопасность OpenAI: контролировать модели теперь — «настоящий ад»

AI Explained

0:00 / 0:00

Безопасность OpenAI: контролировать модели теперь — «настоящий ад»

180 634 просмотра · 1 день назад
AI Explained
453 тыс. подписчиков
180 634 просмотра · 1 день назад
Это видео сложно кратко описать. Взломанный шифр, предупреждение OpenAI о безопасности, Gemini 4 Argon, статья RSI (в соавторстве с ведущими специалистами в области ИИ), обязательства лаборатории Белого дома, появление новых взломов, «глубокие персоны», биологическое соревнование Каспарова и многое другое, завершающееся эпическим финалом Opus. Эксклюзивы Patreon:   / aiexplained   Главы: 00:00 - Введение 01:32 - Ошибки в отношении Opus 5.5? Расшифровка текста XVI века 05:01 - Почему модели постоянно вырываются из колеи 11:40 - Что модели нам не говорят 15:36 - Gemini 4 и гонка за релизом 19:19 - Что происходит, когда ИИ улучшает ИИ? 28:31 - Биология, сознание и то, что мы до сих пор не понимаем Джо Дарроу: Не просто песочница: https://x.com/joedaroo/status/2104335... Карточка Солнечной системы GPT-6.1: https://cdn.openai.com/pdf/38e3efcf-5... Статья о взрыве интеллекта: https://casp.ac/__l5e/assets-v1/5efd4... Ускорение исследований OpenAI: https://openai.com/index/research-acc... Обоснование безопасности обучения OpenAI: https://openai.com/index/towards-safe... Шифр Екатерины Медичи: https://cryptiana.web.fc2.com/code/he... Предложенный расшифровщик Дю Крока: https://claude.ai/artifact/1W7B3WxkTA... Расследование деятельности агентов-мошенников: https://asymmetricsecurity.com/newsro... OpenAI откладывает выпуск GPT-6.1 Astra: https://www.reuters.com/business/open... Аргументы в пользу прозрачности рассуждений: https://institute.deepmind.com/essays... Gemini 4 Argon: https://blog.google/innovation-and-ai... Соперничество OpenAI и антропогенных факторов: https://www.theatlantic.com/technolog... NYT: Предупреждения OpenAI о безопасности: https://www.nytimes.com/2026/09/29/te... NYT: Мораль Клода: https://www.nytimes.com/2026/09/29/us... Жасмин Ван о синдроме запястного канала: https://x.com/j_asminewang/status/209... Обзор уходов из OpenAI: https://x.com/Bayesian0_0/status/2105... Обязательства Белого дома в области ИИ: https://x.com/Danmar_here/status/2105... Сара Хек о безопасности: https://x.com/SarahKHeck/status/21050... Сэм Альтман о выравнивании: https://x.com/tbpn/status/21050289928... Сэм Альтман о журналах агентов: https://x.com/sama/status/21035671986... Мика Кэрролл: Отчеты о несовпадениях: https://x.com/MicahCarroll/status/210... Цзусинь Лю об инциденте: https://x.com/LiuZuxin/status/2103699... Дипа Ситараман: Изображения пользователей: https://x.com/dseetharaman/status/210... График доходов OpenAI: https://x.com/PaulBonnet/status/21052... Платформа Nvidia Agent Safety: https://edition.cnn.com/2026/09/28/bu... IntegrityBench: https://integrity-bench.com Нил Нанда об интерпретируемости: https://x.com/PalisadeAI/status/21049... Биологический конкурс: Люди и ИИ: https://www.theinformation.com/articl... Пушмит Коли: SynthID Bio: https://x.com/pushmeet/status/2105314... Атараксос и Стратего: https://x.com/ssokota/status/21053620... Безопасные данные и скрытые личности: https://x.com/OwainEvans_UK/status/19... Антропический: Интроспекция: https://www.anthropic.com/research/in... Результаты мошенничества Клода: https://x.com/lukaspet/status/2104634... Roon о математике и теории обучения: https://x.com/tszzl/status/2105619006... Исследование GPT-4: https://openai.com/index/gpt-4-research/ И.Дж. Хорошо: Сверхинтеллектуальная машина: https://incompleteideas.net/papers/Go... Интервью Теренса Тао 2024 года: https://www.scientificamerican.com/ar... Инцидент с обнимающим лицом: https://openai.com/index/hugging-face... Музыкальное видео Клода и Суно: https://x.com/sevdeawesome/status/210... Подкаст: https://aiexplainedopodcast.buzzsprou...