登录体验完整功能(收藏、点赞、评论等) — 已累计有 13115 人加入

小鹏发布TuringViT视觉编码器 1/10数据即可超越现有SOTA基线

详情页推荐

2026年7月21日,小鹏集团正式发布TuringViT高效视觉编码器,该产品通过对架构、数据范式与训练流程的系统性重构,仅用行业常规十分之一的训练数据即可超越现有SOTA基线,可支撑智能驾驶、智能座舱、IRON人形机器人三大核心场景,为全行业提供低成本可复现的顶尖视觉Transformer训练路径,推动先进视觉大模型能力走向普惠。

长期以来,顶尖视觉大模型的研发始终被高成本约束:要达到行业公认的SOTA效果,往往需要囤积数十亿张级别的标注图像、投入数千万元的算力资源,普通创业公司和垂直行业团队根本无法负担,导致先进视觉能力长期成为全球少数科技巨头的专属资源,很多垂直场景的视觉应用落地进度被大幅拖慢。

此次小鹏发布的TuringViT,从架构设计、数据治理、训练流程三个维度完成了系统性重构,搭建起线性注意力主导、高质量数据治理、原生动态分辨率三位一体的技术体系,彻底打破了“要效果必须堆量”的行业固有认知。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。