Перейти к содержимому

L4 TRPO and PPO (Foundations of Deep RL Series)

Pieter Abbeel

0:00 / 0:00

L4 TRPO and PPO (Foundations of Deep RL Series)

53 343 просмотра · 5 лет назад
Pieter Abbeel
26,2 тыс. подписчиков
53 343 просмотра · 5 лет назад
Lecture 4 of a 6-lecture series on the Foundations of Deep RL Topic: Trust Region Policy Optimization (TRPO) and Proximal Policy Optimization (PPO) Instructor: Pieter Abbeel Slides: https://www.dropbox.com/s/bodgpysmm6l...