Защита вашей LLM: как остановить промпт-инъекции и джейлбрейки в Azure AI Foundry
Tech with Kirk
0:00 / 0:00
Защита вашей LLM: как остановить промпт-инъекции и джейлбрейки в Azure AI Foundry
1 868 просмотров · 1 год назад
Tech with Kirk
2,75 тыс. подписчиков
1 868 просмотров · 1 год назад
🚨 Ваш чат-бот с ИИ только что допустил утечку личных данных или начал давать… сомнительные советы? Это атака с использованием взлома системы (jailbreak) — и сегодня я покажу вам, как это остановить.
В этом видео я расскажу вам о защитных механизмах для ИИ и о том, как использовать Content Safety от Azure AI Foundry для защиты ваших LLM-ов и ИИ-агентов. Мы рассмотрим:
✅ Что такое взлом системы (и почему он опасен)
✅ Входные и выходные защитные механизмы
✅ Как настроить контентные фильтры (ненависть, сексуальный контент, насилие, членовредительство)
✅ Защита от внедрения подсказок и косвенных атак
✅ Использование Azure Cognitive Services для создания пользовательских защитных механизмов
Независимо от того, создаете ли вы чат-бота, ИИ-агента или интегрируете LLM-ов в свой бизнес, защитные механизмы имеют решающее значение для обеспечения безопасности, соответствия требованиям и надежности вашей системы.
🔹 Разделы:
0:00 – Ваш ИИ-агент только что взломан…
1:20 – Что такое защитные механизмы ИИ?
3:40 – Обзор безопасности контента Azure AI
6:10 – Тестирование защитных механизмов в тестовой среде
10:45 – Блокировка атак взлома (подсказка DAN)
14:30 – Использование защитных механизмов в вашем собственном конвейере
👉 Подпишитесь, чтобы не пропустить следующее видео о защитных механизмах вывода и оценке LLM!