Обучение с подкреплением в условиях разреженных наград
Arxiv Insights
0:00 / 0:00
Обучение с подкреплением в условиях разреженных наград
129 823 просмотра · 8 лет назад
Arxiv Insights
103 тыс. подписчиков
129 823 просмотра · 8 лет назад
В этом видео я подробно рассматриваю три продвинутые статьи, посвященные проблеме разреженного вознаграждения в глубоком обучении с подкреплением и предлагающие интересные направления исследований для освоения обучения без учителя в автономных агентах.
Обсуждаемые статьи:
Обучение с подкреплением с использованием вспомогательных задач без учителя — DeepMind:
https://arxiv.org/abs/1611.05397
Исследование, движимое любопытством — Калифорнийский университет в Беркли:
https://arxiv.org/abs/1705.05363
Воспроизведение опыта задним числом — OpenAI:
https://arxiv.org/abs/1707.01495
Если вы хотите поддержать этот канал, вот моя ссылка на Patreon:
/ arxivinsights --- Вы потрясающие!! ;)
Если у вас есть вопросы, которые вы хотели бы обсудить со мной лично, вы можете записаться на видеозвонок один на один через Pensight: https://pensight.com/x/xander-steenbr...