苏州钰尚传媒-商业品牌企业运营服务商-专业高端视频拍摄服务、商业品牌宣传片制作、企业产品广告片TVC微电影拍摄、活动会议跟拍、AI视频短剧制作、纪录专题片拍摄、媒体宣传发布推广、品牌宣传软文发布、苏州广告标识牌设计制作、钰尚文化传媒——合作咨询 联系微信:esay8168 ,联系:电话18888186853微信同号

扫微信二维码

联系

电话18888186853微信同号




这里是文章模块栏目内容页
小米自动驾驶模型Xiaomi OneVL开源:业内率先统一VLA、世界模型路线

快科技5月13日消息,今日,小米正式发布并开源Xiaomi OneVL自动驾驶模型

该模型在业内率先实现VLA、世界模型、潜空间推理等多个技术路线的统一,在具备XLA模型强悍推理能力的基础上,大幅提升了推理的速度和精度,是行业内具备开创性的方案。

其在精度上超越显式CoT、在速度上对齐仅答案”预测的潜空间CoT方案。过去,VLA和世界模型是自动驾驶领域两条相对独立的技术路线:VLA专注于理解场景并输出驾驶动作,世界模型专注于预测未来场景的演变。

XiaomiOneVL通过潜空间推理,首次将两者统一到同一套框架中。

小米自动驾驶模型Xiaomi OneVL开源:业内率先统一VLA、世界模型路线

在涵盖感知、推理与规划的多个主流基准上,Xiaomi OneVL全面刷新潜在推理方法的性能上限:

在ROADWork、Impromptu、Alpamayo-R1三项基准上均达到SOTA,并在NAVSIM上取得优越性能,PDM-score达到88.84,首次在潜空间推理中超越显式 CoT(88.29);

目前唯一在所有基准上超越显式自回归CoT的隐式推理方法;

挂载MLP回归头变体,延迟进一步压到0.24s(4.16 Hz),仅为VLA自回归推理的5.4%,为量产车端实时部署提供了可行路径。

消融实验进一步验证,压缩物理世界的动态信息能带来显著的性能提升。

同时,Xiaomi OneVL能为模型决策提供语言和视觉双维度的可解释性既能用文字说明为什么这样开”,也能用预测画面展示接下来会发生什么”

()

(来源:站长之家)
免责声明:本站文章部分内容为本站原创,另有部分容来源于第三方或整理自互联网,其中转载部分仅供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对其内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。
传媒行业的商业全面服务 与您共创美好未来
合作共赢
  • 交互式网络传媒领域
  • 资源丰富,体系完善
  • 创造更加精准、有效的,线上线下互动品牌整合服务
  • 多年传媒行业尽管,见证品牌及产品的蜕变、递增和成长
创造优势
苏州钰尚传媒-商业品牌企业运营服务商最新资讯
致力于传媒行业领域的专业公司