国产视觉AI技术突围,夯实行业竞争壁垒
依托2026年世界人工智能产业大会释放的升级信号,国内物理AI、具身智能产业迎来规模化落地关键窗口期。近期,小鹏集团推出自研TuringViT高效视觉编码器,补齐了物理AI领域的底层技术短板,重构视觉大模型训练与落地范式,为智能汽车、人形机器人等AI终端的产业化落地筑牢技术根基。
当前国内AI产业正加速从通用大模型研发,转向实体场景深度落地。据小鹏通用智能中心负责人刘先明介绍,视觉编码器是物理AI的核心感知入口,也是衔接人工智能与真实物理世界的重要底座。目前行业通用视觉模型存在明显短板,普遍面临算力成本高昂、数据处理效率低、场景适配性较差等问题,无法满足高分辨率、多视角、动态复杂场景的端侧实时运算需求,成为阻碍物理AI商业化普及的核心瓶颈。

“针对行业痛点,小鹏自研的TuringViT是基于软硬结合理念打造的通用视觉工具,攻克了视觉信息处理的核心难题。”刘先明强调,该技术具备强大的零样本能力,无需针对不同场景大规模采集专项数据,可从底层架构搭建出适配自动驾驶、座舱交互、人形机器人的通用基础能力。同时,这项技术也为小鹏智能驾驶从L2到L4级别迭代、智能化技术出海提供了核心支撑。
目前,TuringViT已全面落地小鹏智能驾驶、智能座舱、IRON人形机器人三大核心业务场景,有效推动品牌新一代VLA系统完成迭代升级。业内分析认为,在AI产业全面提速的背景下,小鹏此次底层技术突破,不仅进一步构筑了自身在物理AI领域的技术壁垒,还打造出可复制、低成本的行业解决方案,推动国内高端视觉AI技术走出实验室、走向产业化,加速全行业物理AI技术普惠落地。
文、图|记者 潘亮