任少卿团队提出MM-Future多模式世界—动作联合模型,可一次生成多组场景—动作假设并共同演化,再筛选最优轨迹。该模型通过MM-Tokens压缩视觉特征、Best-of-Many监督和专属未来评分器,在NAVSIM上PDMS达94.0,验证了多模式联合建模能稳定提升规划指标,但计算开销与隐式表征仍待解决。
完成下面两步后,将自动完成登录并继续当前操作。