自动驾驶论文速递Auto-JEPA
自动驾驶论文日报 · 2026-08-16
今天精读一篇最近讨论度很高的清华团队论文:Auto-JEPA。
它想回答一个问题:自动驾驶的世界模型,真的需要把未来视频、占用、BEV 全都重建出来吗?
论文的答案是:不用。规划只需要抓住“影响自车未来动作”的那部分信息就够了。
核心做法:把未来轨迹编码成一个连续的“驾驶意图”隐向量,训练 JEPA 预测器去对齐它;推理时用这个意图向量去固定轨迹记忆库检索 Top-K 候选,再用场景条件打分器 + 可行驶区域门控选出最终轨迹。
结果:NAVSIM v1 91.3 PDMS,v2 89.1 EPDMS;只用 1 个前视相机,无感知标注。
更有意思的是语义遮挡实验:遮住对未来规划有实质影响的车辆,意图变化是随机遮挡的 2.97 倍。
计算机视觉 带你一起读论文 机器学习 深度学习




