小鹏:第二代 VLA 升级的核心是建立对时间维度的理解
小鹏汽车通用智能中心负责人刘先明表示,第二代视觉—语言—动作(VLA)模型首次将时间维度纳入模型。新推出的 Infini-VLA 长时序架构可记忆此前 30 秒的环境信息,为驾驶判断提供更长的上下文。小鹏还采用流式自回归推理,并宣称端到端响应速度提升 300%,使模型能够在道路状况不断变化时并行完成观察、思考和行动。相关性能数据来自小鹏的企业介绍,报道未提供独立测试或第三方验证。
本文来源:IT之家,仅供学习参考,版权归原作者所有。