EN 提交工具

Qwen3 VL 235B A22B Instruct

日耗榜 #129 qwen

qwen/qwen3-vl-235b-a22b-instruct

用量数据日期 2026-07-26 · 每日更新

用量与规格

日耗榜排名#129
日 Tokens13.6B
日请求5.5M
日变化 +16.8%
上下文窗口131.1K
发布时间

Qwen3 VL 235B A22B Instruct 是什么

Qwen3-VL-235B-A22B Instruct 是一个开放权重的多模态模型,将强大的文本生成能力与图像及视频的视觉理解能力相统一。该 Instruct 模型面向通用视觉语言应用(如视觉问答、文档解析、图表/表格提取、多语言OCR)。该系列强调稳健的感知能力(识别多样化的真实世界与合成类别)、空间理解能力(2D/3D定位)以及长篇幅视觉理解,在公开多模态基准测试中,其感知与推理能力均取得了具有竞争力的结果。 除分析功能外,Qwen3-VL 还支持智能体交互与工具使用:它能够遵循多图像、多轮对话中的复杂指令;将文本与视频时间线对齐以执行精确的时间查询;并操作 GUI 元素完成自动化任务。该模型还支持可视化编码工作流——将草图或原型转化为代码,并协助 UI 调试——同时保持与旗舰级 Qwen3 语言模型相当的纯文本性能。这使得 Qwen3-VL 适用于涵盖文档AI、多语言OCR、软件/UI辅助、空间/具身任务以及视觉语言智能体研究的各类生产场景。

Qwen3 VL 235B A22B Instruct 的能力

输入:文本、图像   输出:文本

JSON 输出 结构化输出 工具选择 工具调用 知识截止 2025-03-31

Qwen3 VL 235B A22B Instruct 的 API 定价

输入 · 每百万 tokens¥1.42
输出 · 每百万 tokens¥12.88

价格为公开刊例(人民币按 1 美元 ≈ 6.78 元换算),实际以各服务商官网为准。

用这个模型的工具