Перейти к содержимому

An Alternative Softmax Operator for Reinforcement Learning

Simons Institute for the Theory of Computing

0:00 / 0:00

An Alternative Softmax Operator for Reinforcement Learning

1 166 просмотров · Трансляция закончилась 5 лет назад
Simons Institute for the Theory of Computing
76,7 тыс. подписчиков
1 166 просмотров · Трансляция закончилась 5 лет назад
Michael Littman (Brown University) An Alternative Softmax Operator for Reinforcement Learning Mathematics of Online Decision Making