新浪财经 07-21
小鹏集团发布TuringViT视觉基座模型,覆盖智驾、座舱、机器人全场景
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

来源:新浪科技

新浪科技讯 7 月 21 日晚间消息,近日,小鹏正式发布 TuringViT 高效视觉编码器,面向 VLM/VLA 时代系统性重构视觉编码器的架构设计、数据范式与训练流程。TuringViT 将全面支撑智能驾驶、智能座舱、IRON 人形机器人三大业务场景。

视觉编码器是物理 AI 的 " 感知入口 " —— 所有场景理解、状态判断、动作决策的第一步,都始于高质量的视觉特征提取。行业普遍采用的 " 复用开源通用 ViT" 方案,已难以匹配智能驾驶、具身机器人等真实场景对性能、延迟与定制化的综合需求。TuringViT 正是小鹏针对这一行业痛点给出的系统性解决方案。TuringViT 从架构、数据、训练三个维度同步突破,打造了 " 线性注意力主导 + 高质量数据治理 + 原生动态分辨率 " 的完整技术体系,实现了效果、效率与落地性的三重提升。

随着 TuringViT 的发布,小鹏全栈自研的物理 AI 底层技术能力逐步完善和丰富。小鹏的物理 AI 底层技术能力,也不仅仅服务于智能辅助驾驶,更将赋能更多物理 AI 业务场景。包括赋能 VLA 2.0,让高分辨率感知真正落地车端;升级座舱交互,实现视觉与语言的自然融合;夯实具身基础,为 IRON 机器人打造通用视觉能力。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

机器人 ai 小鹏 物理 智能驾驶
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论