Перейти к содержимому

MIT 6.S191 (2024): Обучение с подкреплением

Alexander Amini

0:00 / 0:00

MIT 6.S191 (2024): Обучение с подкреплением

127 703 просмотра · 2 года назад
Alexander Amini
357 тыс. подписчиков
127 703 просмотра · 2 года назад
Введение в глубокое обучение MIT 6.S191: Лекция 5 Глубокое обучение с подкреплением Лектор: Александр Амини Издание 2024 года Все лекции, слайды и материалы для лабораторных работ: http://introtodeeplearning.com План лекции: 0:00 - Введение 2:20 - Классы задач обучения 6:33 - Определения 12:30 - Q-функция 17:29 - Более подробное рассмотрение Q-функции 23:12 - Глубокие Q-сети 30:36 - Результаты Atari и ограничения 34:24 - Алгоритмы обучения политики 39:31 - Дискретные и непрерывные действия 43:21 - Градиенты обучения политики 49:10 - Обучение с подкреплением в реальной жизни 51:33 - Симулятор VISTA 53:24 - AlphaGo, AlphaZero и MuZero 58:58 - Резюме Подпишитесь, чтобы быть в курсе новых лекций по глубокому обучению Слушайте лекции в MIT или следите за нами в Twitter и Instagram @MITDeepLearning, чтобы оставаться на связи!