随机方差缩减的递归动量策略梯度方法
辛垚辉,李永强,冯宇,胡磊
Stochastic variance-reduced recursive momentum policy gradient method
Yaohui XIN,Yongqiang LI,Yu FENG,Lei HU
表 3
基准实验参数设置
Tab.3
Benchmark experimental parameter settings
算法
$ \gamma $
$ \eta $
$ \alpha $
$ p_{t} $
$ {p}_{0} $
$ S_{1} $
$ B $
$ Q $
GPOMDP
0.99
0.01
—
—
—
—
—
—
STORM-PG
0.99
0.01
0.9
—
—
20
5
—
PAGE-PG
0.99
0.01
—
0.3
—
20
5
—
SHARP
0.99
0.01
0.9
—
—
20
5
—
SVRRM-PG
0.99
0.01
0.9
—
0.3
20
5
100