Перейти к содержимому

Обучение с подкреплением в условиях разреженных наград

Arxiv Insights

0:00 / 0:00

Обучение с подкреплением в условиях разреженных наград

129 823 просмотра · 8 лет назад
Arxiv Insights
103 тыс. подписчиков
129 823 просмотра · 8 лет назад
В этом видео я подробно рассматриваю три продвинутые статьи, посвященные проблеме разреженного вознаграждения в глубоком обучении с подкреплением и предлагающие интересные направления исследований для освоения обучения без учителя в автономных агентах. Обсуждаемые статьи: Обучение с подкреплением с использованием вспомогательных задач без учителя — DeepMind: https://arxiv.org/abs/1611.05397 Исследование, движимое любопытством — Калифорнийский университет в Беркли: https://arxiv.org/abs/1705.05363 Воспроизведение опыта задним числом — OpenAI: https://arxiv.org/abs/1707.01495 Если вы хотите поддержать этот канал, вот моя ссылка на Patreon:   / arxivinsights   --- Вы потрясающие!! ;) Если у вас есть вопросы, которые вы хотели бы обсудить со мной лично, вы можете записаться на видеозвонок один на один через Pensight: https://pensight.com/x/xander-steenbr...