集成多智能体强化学习和最大压强控制的混行交叉口协同控制
曹宁博,万启超,赵利英,李梓萌,黄宝林

Collaborative control of mixed traffic intersections integrating multi-agent reinforcement learning and maximum pressure control
Ningbo CAO,Qichao WAN,Liying ZHAO,Zimeng LI,Baolin HUANG
图 7 不同算法训练回合平均奖励值
Fig.7 Average reward value of training rounds for different algorithms