选项
首页
快讯
内容
AlbertKing
AlbertKing
2026-07-21

小鹏集团推出了TuringViT,这是一种高效的视觉编码器,通过重构架构、数据和训练方式,实现了低成本的SOTA视觉变换器。它支持智能驾驶、座舱及类人机器人。 该模型仅使用0.85B张图像-文本对,便在六个基准测试中实现了83.6%的零样本准确率,性能超越了基于10B数据训练的模型,且在高分辨率下的推理吞吐量达到后者的3倍。

小鹏集团推出了TuringViT,这是一种高效的视觉编码器,通过重构架构、数据和训练方式,实现了低成本的SOTA视觉变换器。它支持智能驾驶、座舱及类人机器人。 该模型仅使用0.85B张图像-文本对,便在六个基准测试中实现了83.6%的零样本准确率,性能超越了基于10B数据训练的模型,且在高分辨率下的推理吞吐量达到后者的3倍。 小鹏集团推出了TuringViT,这是一种高效的视觉编码器,通过重构架构、数据和训练方式,实现了低成本的SOTA视觉变换器。它支持智能驾驶、座舱及类人机器人。 该模型仅使用0.85B张图像-文本对,便在六个基准测试中实现了83.6%的零样本准确率,性能超越了基于10B数据训练的模型,且在高分辨率下的推理吞吐量达到后者的3倍。 小鹏集团推出了TuringViT,这是一种高效的视觉编码器,通过重构架构、数据和训练方式,实现了低成本的SOTA视觉变换器。它支持智能驾驶、座舱及类人机器人。 该模型仅使用0.85B张图像-文本对,便在六个基准测试中实现了83.6%的零样本准确率,性能超越了基于10B数据训练的模型,且在高分辨率下的推理吞吐量达到后者的3倍。
评论 (0)
0/300
OR