Галлюцинации ИИ: почему нейросети так уверенно говорят неправду
Jimmy's Tech Deep Dive
0:00 / 0:00
Галлюцинации ИИ: почему нейросети так уверенно говорят неправду
3 просмотра · 3 дня назад
Jimmy's Tech Deep Dive
9 подписчиков
3 просмотра · 3 дня назад
Модель может быть совершенно неверной и при этом абсолютно уверенной. Вот почему это происходит.
А вот что действительно снижает вероятность ошибок — и что преувеличивается.
12-минутный подробный анализ галлюцинаций в ИИ: что это на самом деле, как прогнозирование следующего токена плюс оценка только точности вознаграждают догадки, а не признание неопределенности, что на самом деле измеряют бенчмарки 2026 года и какие средства защиты снижают скорость их возникновения в производстве. Мы обсуждаем нью-йоркского адвоката, подвергнутого санкциям за шесть вымышленных судебных решений, показатели рейтинга AA-Omniscience, почему рабочие процессы агентов чаще всего приводят к галлюцинациям, и пять привычек, которые выявляют большую часть того, что проходит — включая то, почему «вы уверены?» — худший вопрос, который вы можете задать.
• Чем галлюцинация отличается от обычной ошибки, и две категории исследований
• Почему у механизма нет таблицы фактов — обучающие данные, пробелы в покрытии и поддельные цитаты, которые выглядят идеально
• Аргумент OpenAI о том, что наша система оценок поощряет блеф, а не «я не знаю»
• Реальные измеренные показатели по форме задачи: извлекательный QA, генерация открытых вопросов, цепочки агентов
• RAG, контракты цитирования, оценка неопределенности и агенты-хранители — что каждый из них на самом деле дает вам
• Пять практических привычек для любого, кто использует чат-бота
Главы
0:00 Уверенность и ошибка
0:20 Что такое галлюцинация
1:14 Судебные дела
2:07 Почему механизм изобретает
3:35 Уверенность — это стиль
4:04 Оценка за угадывание
5:40 Как часто это происходит
7:09 Что действительно работает
9:52 Многоуровневая защита, реальные выгоды
10:24 Пять привычек, которые помогают это обнаружить
11:43 Где это находится Заголовок
Источники
Почему языковые модели вызывают галлюцинации — OpenAI — https://openai.com/index/why-language...
AA-Omniscience — Рейтинг частоты галлюцинаций — https://benchlm.ai/benchmarks/omnisci...
Обнаружение и смягчение галлюцинаций LLM: современное состояние в 2026 году — https://zylos.ai/research/2026-01-27-...
Устранение галлюцинаций LLM в радиологии с помощью RAG — https://healthcare-in-europe.com/en/n...
Фальшивые цитирования, реальные последствия: когда ИИ вводит суд в заблуждение — https://fstoppers.com/news/fake-citat...
Что такое галлюцинации ИИ? - IBM - https://www.ibm.com/think/topics/ai-h...
#AIHallucination #RAG #LLM #AISafety #MachineLearning