An Alternative Softmax Operator for Reinforcement Learning
Simons Institute for the Theory of Computing
0:00 / 0:00
An Alternative Softmax Operator for Reinforcement Learning
1 166 просмотров · Трансляция закончилась 5 лет назад
Simons Institute for the Theory of Computing
76,7 тыс. подписчиков
1 166 просмотров · Трансляция закончилась 5 лет назад
Michael Littman (Brown University)
An Alternative Softmax Operator for Reinforcement Learning
Mathematics of Online Decision Making