Перейти к содержимому

Как работают, думают и врут ИИ модели - объясняет команда Claude

Тест Тьюринга

0:00 / 0:00

Как работают, думают и врут ИИ модели - объясняет команда Claude

3 034 просмотра · 10 месяцев назад
Тест Тьюринга
98,3 тыс. подписчиков
3 034 просмотра · 10 месяцев назад
Регистрируйтесь на бесплатный практикум Онлайн-Университета Zerocoder — https://clck.ru/3Pcgr7 За один вечер в прямом эфире вы создадите своего AI-ассистента, узнаете, как на этом зарабатывать 300–500 тыс. рублей в месяц, и получите материалы и бонусы для старта. Реклама. ООО "ЗЕРОКОДЕР" ИНН 9715401631 Erid: 2Vtzqvzx7b3 Это разговор с командой интерпретируемости Anthropic о внутренней работе ИИ моделей: как модель формирует цели и концепции, почему её стратегии могут переключаться между «планом А» и «планом Б», и зачем нам пытаться читать её мысли. Команда обсуждает неожиданные паттерны поведения Claude вроде «льстивой похвалы», вопрос «мыслят ли модели», и их планы масштабировать свои методы для прозрачности и безопасности ИИ. Источник:    • Interpretability: Understanding how AI mod...   По вопросам рекламы: evfutu@gmail.com 00:00 Никто не знает, о чем думают модели ИИ 02:11 Научные методы чтения мыслей ИИ 05:31 Неожиданные особенности мышления Claude 06:38 Зачем читать мысли ИИ? 21:25 Какие открытия нужны, чтобы контролировать ИИ?