Перейти к содержимому

Текст, сгенерированный ИИ: методы обнаружения и способы противодействия

Efficient NLP

0:00 / 0:00

Текст, сгенерированный ИИ: методы обнаружения и способы противодействия

2 694 просмотра · 2 г. назад
Efficient NLP
21,1 тыс. подписчиков
2 694 просмотра · 2 г. назад
Попробуйте Voice Writer — озвучивайте свои мысли, а ИИ позаботится о грамматике: https://voicewriter.io Многие используют ChatGPT и другие LLM для написания текстов, иногда с положительными, иногда с отрицательными результатами. Но возможно ли это обнаружить? Многие утверждают, что существуют способы обнаружения контента, сгенерированного ИИ, такие как классификаторы, методы с нулевым количеством примеров и водяные знаки. Но как эти методы противостоят атакам со стороны злоумышленников, например, моделям перефразирования? Узнайте в этом видео! 0:00 - Введение 1:07 - Измерение использования ChatGPT в корпусе 2:54 - Подход к классификации текста 5:25 - Обнаружение с нулевым количеством примеров 8:08 - Водяные знаки для LLM 10:10 - Атаки с использованием перефразирования 11:54 - Возможно ли обнаружение написанного ИИ? Обзор статей по обнаружению текста, сгенерированного ИИ, и мерам противодействия Госал, Соумья Сувра, Сурадип Чакраборти, Джонас Гейпинг, Фуронг Хуанг, Динеш Маноча и Амрит Сингх Беди. «К возможностям и невозможностям обнаружения текста, сгенерированного ИИ: обзор», без даты. Фрейзер, Кэтлин С., Хиллари Докинс и Светлана Кириченко. «Обнаружение текста, сгенерированного ИИ: факторы, влияющие на обнаруживаемость с помощью современных методов». arXiv, 21 июня 2024 г. http://arxiv.org/abs/2406.15583. Ссылки на статьи, упомянутые в этом видео: Касал, Дж. Эллиотт и Мэтт Кесслер. «Могут ли лингвисты различать ChatGPT/ИИ и человеческий текст?: Исследование этики исследований и академических публикаций». Методы исследования в прикладной лингвистике 2, № 3 (декабрь 2023 г.): 100068. https://doi.org/10.1016/j.rmal.2023.1.... Садасиван, Вину Санкар, Аунон Кумар, Шрирам Баласубраманиан, Вэньсяо Ван и Сохейл Фейзи. «Можно ли надежно обнаружить текст, сгенерированный ИИ?» arXiv, 19 февраля 2024 г. http://arxiv.org/abs/2303.11156. Го, Биян, Синь Чжан, Цзыюань Ван, Миньци Цзян, Цзиньран Ни, Юйсюань Дин, Цзяньвэй Юэ и Юпэн У. «Насколько близок ChatGPT к экспертам-людям? Сравнительный корпус, оценка и обнаружение». arXiv, 18 января 2023 г. http://arxiv.org/abs/2301.07597. Митчелл, Эрик, Юнхо Ли, Александр Хазацкий, Кристофер Д. Мэннинг и Челси Финн. «DetectGPT: обнаружение текста с помощью машинного обучения без предварительного обучения с использованием вероятностной кривизны». arXiv, 23 июля 2023 г. http://arxiv.org/abs/2301.11305. Кирхенбауэр, Джон, Йонас Гейпинг, Юсинь Вэнь, Джонатан Кац, Иан Майерс и Том Голдштейн. «Водяной знак для больших языковых моделей». arXiv, 27 января 2023 г. http://arxiv.org/abs/2301.10226. Кобак, Дмитрий, Рита Гонсалес Маркес, Эмоке-Агнес Хорват и Ян Лаузе. «Изучение использования ChatGPT в академическом письме через избыточную лексику». arXiv, 11 июня 2024 г. http://arxiv.org/abs/2406.07016.