Diffusion Drive的阅读记录

Diffusion Drive的阅读记录 为什么用diffusion 或者vocabulary而不是单一的回归用 “确定性 MLP 回归头” 输出控制指令时输出是单一固定值无法捕捉真实驾驶场景的多模态性比如同一场景下“减速慢行” 或 “小幅避让” 都是合理的决策确定性输出鲁棒性差面对复杂 / 未见过的场景容易输出极端值或不合理指令。条件扩散模型的优势生成式特性不再输出 “单一确定值”而是输出符合真实驾驶分布的一组合理控制指令覆盖多模态决策条件约束扩散过程会受输入的环境观测如道路、障碍物约束保证生成的指令符合场景逻辑鲁棒性更强通过逐步去噪的过程能更好地泛化到复杂 / 噪声场景。