rl-atari/强化学习个人项目报告/models/ppo_parallel_improved_best.pt at 7dea00195e031d16c8cd081a03b77fd1cb970cc3

Files

T

Serendipity 7dea00195e feat: 添加并行训练脚本和奖励塑形以改进PPO性能

引入并行环境训练脚本 train_parallel_improved.py，实现多进程并行数据收集
添加奖励塑形包装器，根据速度、赛道位置和完成圈数调整奖励信号
优化神经网络结构和训练参数，包括更大的rollout缓冲区
删除旧的tensorboard日志文件，创建新的训练运行记录

2026-05-01 09:26:39 +08:00

The file is too large to be shown. View Raw