面向车联网差异化干扰的联邦强化学习资源管理
李幸星,杨凡,黄杰,赖显智,姚凤航,蔡杰良,张妮

Federated reinforcement learning for resource management in vehicular networks with differentiated interferences
Xingxing LI,Fan YANG,Jie HUANG,Xianzhi LAI,Fenghang YAO,Jieliang CAI,Ni ZHANG
表 1 仿真实验参数列表
Tab.1 Simulation parameters
参数
学习率0.0001
训练次数1000
客户端数量10
经验回放池大小15000
优化器Adam
带宽/ MHz20
折扣率0.95
发送端数量[20,25,30,35,40,45]
载波频率/ GHz2
小批量样本数量64