MIT 6.S191 (2024): Обучение с подкреплением
Alexander Amini
0:00 / 0:00
MIT 6.S191 (2024): Обучение с подкреплением
127 703 просмотра · 2 года назад
Alexander Amini
357 тыс. подписчиков
127 703 просмотра · 2 года назад
Введение в глубокое обучение MIT 6.S191: Лекция 5
Глубокое обучение с подкреплением
Лектор: Александр Амини
Издание 2024 года
Все лекции, слайды и материалы для лабораторных работ: http://introtodeeplearning.com
План лекции:
0:00 - Введение
2:20 - Классы задач обучения
6:33 - Определения
12:30 - Q-функция
17:29 - Более подробное рассмотрение Q-функции
23:12 - Глубокие Q-сети
30:36 - Результаты Atari и ограничения
34:24 - Алгоритмы обучения политики
39:31 - Дискретные и непрерывные действия
43:21 - Градиенты обучения политики
49:10 - Обучение с подкреплением в реальной жизни
51:33 - Симулятор VISTA
53:24 - AlphaGo, AlphaZero и MuZero
58:58 - Резюме
Подпишитесь, чтобы быть в курсе новых лекций по глубокому обучению Слушайте лекции в MIT или следите за нами в Twitter и Instagram @MITDeepLearning, чтобы оставаться на связи!