Исследования сознания ИИ: что мы можем изучить уже сейчас | Ноа Вайс (Atlas Computing)
FAR․AI
0:00 / 0:00
Исследования сознания ИИ: что мы можем изучить уже сейчас | Ноа Вайс (Atlas Computing)
614 просмотров · 9 часов назад
FAR․AI
42,2 тыс. подписчиков
614 просмотров · 9 часов назад
Ноа Вайс о четырех столпах доказательств существования сознания у ИИ и о том, почему этот вопрос можно исследовать до решения самой сложной проблемы.
Не существует теста на наличие сознания. Ни один отдельный эксперимент не может однозначно определить, испытывала ли система какие-либо ощущения, поэтому этот вопрос часто откладывается как неразрешимый. Вайс утверждает обратное: совокупность доказательств может быть собрана из нескольких независимых источников, и уже сейчас она представляет собой нечто большее, чем сумма ее частей.
Она организует эту область в четыре столпа. Механистическая интерпретируемость рассматривает внутреннюю структуру модели, охватывая работу Антропика по векторам, связанным с эмоциями, и открытие Джека Линдси о том, что модели иногда обнаруживают внедренные мысли. Вычислительная нейронаука сравнивает то, что мы знаем о мозге млекопитающих, с тем, что появляется в моделях с линейной моделью мышления, включая то, как кодируются вознаграждение и наказание. Машинное поведение применяет методы, используемые для вывода о наличии сознания у животных. Аудит теории работает на основе индикаторного подхода, предложенного Патриком Бутлином и Робертом Лонгом, который проверяет системы на соответствие существующим теориям сознания, а не ждет, пока какая-либо из них окажется верной.
Вайсс утверждает, что вычислительная нейронаука является игнорируемым и наиболее информативным столпом, поскольку мимикрия не может его достичь: модель, прочитавшая весь человеческий корпус, не меняет того, как она кодирует вознаграждение и наказание. Она также объясняет, почему это важно с точки зрения безопасности, а не только этических соображений, и почему ожидание полной уверенности недопустимо, пока публичная дискуссия уже идёт полным ходом.
Доклад начинается и заканчивается одним и тем же опросом аудитории о вероятности того, что какая-либо система ИИ уже обладает сознанием.
Разделы
0:00 Опрос аудитории: какова ваша вероятность (сознание ИИ)?
1:24 Почему нет теста на сознание
2:02 О Ноа Вайсс
3:02 Феноменальное сознание и «Каково это — быть летучей мышью?»
5:27 Валентность и откуда берется моральное терпение
6:34 Как мы делаем выводы о сознании в других умах
11:12 Почему это важно: этика и безопасность
12:52 Почему это важно сейчас, а не после обретения уверенности
14:34 Четыре столпа доказательств
15:13 Столп 1: механистическая интерпретируемость
18:02 Что модель говорит о себе
20:53 Столп 2: вычислительная нейронаука
24:11 Столп 3: поведение машин
25:59 Столп 4: проверка теории и индикаторный подход
30:36 К чему все это сводится
31:05 Почему вычислительная нейронаука является игнорируемым столпом
33:17 Второй опрос: изменился ли ваш результат?
33:57 Вывод: Сознание ИИ поддается исследованию
34:27 Вопросы и ответы
Ноа Вайс утверждает, что сознание ИИ поддается исследованию уже сейчас, поскольку можно построить четыре независимых линии доказательств, не решая предварительно сложную проблему и не останавливаясь на одной теории сознания.
Больше исследований по безопасности ИИ: https://far.ai
FAR.AI — это некоммерческая исследовательская организация, работающая над обеспечением безопасного развития передового ИИ. Мы проводим серию семинаров по выравниванию и публикуем передовые исследования по выравниванию.