Tags
5 pages
强化学习
DriveReward 论文阅读笔记
EponaV2: Driving World Model with Comprehensive Future Reasoning
RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework
DiffusionDriveV2: Truncated Diffusion Model for End-to-End Autonomous Driving
Plan-R1: Safe and Feasible Trajectory Planning as Language Modeling