EN 提交工具

Qwen3 VL 8B Instruct

日耗榜 #126 qwen

qwen/qwen3-vl-8b-instruct

用量数据日期 2026-07-26 · 每日更新

用量与规格

日耗榜排名#126
日 Tokens14B
日请求13.7M
日变化 +43.1%
上下文窗口256K
发布时间

Qwen3 VL 8B Instruct 是什么

Qwen3-VL-8B-Instruct 是 Qwen3-VL 系列中的多模态视觉语言模型,专为跨文本、图像和视频的高保真理解与推理而设计。它采用改进的多模态融合技术,包括用于长时域推理的 Interleaved-MRoPE、用于细粒度视觉-文本对齐的 DeepStack,以及用于精确事件定位的文本-时间戳对齐。 该模型支持原生 256K token 上下文窗口,可扩展至 1M token,并能处理静态和动态媒体输入,适用于文档解析、视觉问答、空间推理和 GUI 控制等任务。其文本理解能力可媲美领先的大语言模型,同时将 OCR 覆盖范围扩展至 32 种语言,并在多种视觉条件下增强了鲁棒性。

Qwen3 VL 8B Instruct 的能力

输入:图像、文本   输出:文本

JSON 输出 结构化输出 工具选择 工具调用

Qwen3 VL 8B Instruct 的 API 定价

输入 · 每百万 tokens¥0.79
输出 · 每百万 tokens¥3.08

价格为公开刊例(人民币按 1 美元 ≈ 6.78 元换算),实际以各服务商官网为准。

用这个模型的工具