
改进的Nash Q学习,旨在解决多主体游戏中存在的公平性问题。
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
通过奖励分享机制优化纳什Q学习算法,旨在针对多主体游戏运行培训场景,使用Python 3脚本在src/main.py中配置并运行纳什Q学习,并通过env-config参数指定gridmaze环境配置。
全部评论 (0)
还没有任何评论哟~


简介:
通过奖励分享机制优化纳什Q学习算法,旨在针对多主体游戏运行培训场景,使用Python 3脚本在src/main.py中配置并运行纳什Q学习,并通过env-config参数指定gridmaze环境配置。


