7dea00195e031d16c8cd081a03b77fd1cb970cc3
引入并行环境训练脚本 train_parallel_improved.py,实现多进程并行数据收集 添加奖励塑形包装器,根据速度、赛道位置和完成圈数调整奖励信号 优化神经网络结构和训练参数,包括更大的rollout缓冲区 删除旧的tensorboard日志文件,创建新的训练运行记录
…
…
Description
No description provided
Languages
Jupyter Notebook
52.3%
Python
33.9%
TeX
13.8%