模型
小鹏集团发布 TuringViT 高效视觉编码器
小鹏集团发布面向 VLM/VLA 时代的 TuringViT 视觉编码器,推出 18L 和 24L 两个规格。该编码器在 1536×1536 分辨率下推理吞吐量达 Seed1.5-ViT 的 3.04 倍,仅用 0.85B 图文对便在六项零样本分类基准上取得 83.6% 平均准确率,超越使用 10B 数据的基线。
资讯动态数据由 AI HOT 聚合提供
小鹏集团发布面向 VLM/VLA 时代的 TuringViT 视觉编码器,推出 18L 和 24L 两个规格。该编码器在 1536×1536 分辨率下推理吞吐量达 Seed1.5-ViT 的 3.04 倍,仅用 0.85B 图文对便在六项零样本分类基准上取得 83.6% 平均准确率,超越使用 10B 数据的基线。
资讯动态数据由 AI HOT 聚合提供