
이미지: X — 뉴스 앰프
摘要
- XPeng Global Group General Intelligence中心负责人Liu Xiaoming公开了关于VLA 2.0的独家专访
- 据悉,专访涉及自动驾驶失效的具体环节、进军欧洲的时间点,以及距离Robotaxi商业化还有多远
- 具体回答内容通过YouTube视频公开,推文摘录中并未包含
- 인터뷰 대상
- 리우 시아오밍(Liu Xianming), XPeng Global Group 제너럴 인텔리전스 센터장
- 공개 채널
- X 계정 Chubby(뉴스 앰프) 및 유튜브
- 다룬 주제
- VLA 2.0 실제 성능, 자율주행 실패 지점, 유럽 진출 시점, 로보택시 상용화 거리
- 발행일
- 2026-08-11
公开了什么
新闻聚合账号Chubby在X上公开了与XPeng Global Group General Intelligence中心负责人Liu Xiaoming进行的独家专访。据悉,专访提出的问题包括:XPeng正在开发的VLA 2.0技术究竟能做到什么、自动驾驶目前仍会失效的环节在哪里、这项技术何时能进入欧洲市场,以及距离全自动驾驶车辆投入使用还有多远。不过,公开的文字内容似乎只包含了问题列表,具体回答内容只能通过另外附上的YouTube视频链接查看。
VLA是什么,为何困难
VLA(Vision-Language-Action)是一种在单一模型内,将摄像头看到的画面与语言推理连接起来,并转化为实际驾驶动作(转向、加速、制动)的方案。如果说以往的自动驾驶软件将感知、判断、控制拆分成独立模块分别处理,那么VLA更接近于将大语言模型习得的常识性推理能力,直接引入驾驶判断之中。特斯拉的FSD也在朝着类似方向演进,而在中国电动车企业之间,将这一路线视为自动驾驶下一阶段的看法正在增多。XPeng虽然起步于电动车制造商,但已将业务延伸至自研自动驾驶技术栈、人形机器人以及城市空中交通(eVTOL)领域,本次专访中提到的"General Intelligence中心"这一组织名称本身,就体现出该公司将自动驾驶视为整体物理AI版图中一环的方向性。
正如NVIDIA于8月5日公开的DGX Spark多机互联指南所示,近期物理AI行业正集中关注如何在本地和边缘环境中实时运行大型模型。在自动驾驶汽车内无延迟地运行VLA模型,也是同一脉络下的课题。
那么,有什么变化
此次专访似乎是XPeng首次以负责人亲口回答的形式,公开VLA 2.0的实际性能表现以及进军欧洲的路线图。相比标准化基准测试,能够通过开发负责人的直接发言了解自动驾驶技术的机会并不常见,因此一旦YouTube视频公开,将有望成为衡量中国自动驾驶阵营技术成熟度及其进入欧洲市场时间点的重要参考资料。


