SimWAM:端到端自动驾驶的简化世界动作模型
世界动作模型通过迁移视频动力学先验提升自动驾驶动作预测,但现有方法推理时需昂贵的未来生成。SimWAM仅将视频生成作为训练信号,通过联合流匹配共同训练,推理时可丢弃视频分支。
查看原文解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。
世界动作模型通过迁移视频动力学先验提升自动驾驶动作预测,但现有方法推理时需昂贵的未来生成。SimWAM仅将视频生成作为训练信号,通过联合流匹配共同训练,推理时可丢弃视频分支。
查看原文