返回热力追踪
关注模型发布

小鹏发布TuringViT高效视觉编码器 支撑三大核心智能业务

2026年7月21日,小鹏集团正式发布面向VLM/VLA时代的TuringViT高效视觉编码器,推出18L、24L两个规格。该编码器在性能与数据效率上均超越基线,将落地三大智能业务。

编辑视角

这是小鹏面向多模态具身场景自研的核心视觉模型,既支撑自身业务升级,也为行业提供低成本方案,对自动驾驶、机器人领域有参考价值。

深度解读

本次小鹏发布的TuringViT是针对VLM/VLA时代重构的视觉编码器,从架构、数据、训练三个维度实现技术突破。实测显示,其在1536×1536分辨率下推理吞吐量达Seed1.5-ViT的3.04倍,仅用0.85B图文对就取得超越10B数据基线模型的准确率,将全面应用于小鹏智能驾驶、智能座舱、IRON人形机器人三大核心业务,同时对外提供可复现的低成本训练路径,推动视觉大模型行业普惠。边界:目前仅公布官方性能数据与落地规划,未开放模型或代码,也未公布对外合作的具体方案,暂无第三方独立验证结果。后续需观察其开放进度与第三方实测表现。

核心要点
  • 2026年7月小鹏正式发布TuringViT高效视觉编码器
  • 性能数据效率突出,推理吞吐量达Seed1.5-ViT的3.04倍
  • 将支撑三大核心智能业务,提供行业低成本训练路径