Qwen3-VL-8B-Instruct 是什么模型?
Qwen3-VL-8B-Instruct 是阿里巴巴于 2025-10-15 发布的多模态大模型。支持文本、图像、视频输入和文本输出,上下文窗口为 256K。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。
Qwen3-VL-8B-Instruct
Qwen3-VL-8B-Instruct 是阿里巴巴于 2025-10-15 发布的多模态大模型。支持文本、图像、视频输入和文本输出,上下文窗口为 256K。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | ¥0.0015/ 1K | ¥0.0060/ 1K |
暂时没有为该模型整理的相关对比页面。
想自定义其他组合?打开对比工具
Qwen3-VL 8B 属于 Qwen3-VL 系列的中型开源权重,面向图像/视频/文本的统一理解与推理。根据官方模型卡与说明,Qwen3-VL 在本代提供了更长的上下文支持(原生 256K,扩展至 1M)、更强的视觉-文本对齐(DeepStack 多层特征融合)与时间建模(文本-时间戳对齐),并在 GUI 要素识别与工具调用等“视觉代理”场景中提供能力示例。
模型卡显示参数量约 8.77B;提供 Transformers 直接调用与推理超参示例。
Qwen3-VL-8B-Instruct 是阿里巴巴于 2025-10-15 发布的多模态大模型。支持文本、图像、视频输入和文本输出,上下文窗口为 256K。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。
当前官方资料记录其支持文本、图像、视频输入,并生成文本输出。
上下文窗口为 256K。未公开或无法确认的规格不做推测。
页面已收录 阿里巴巴 的 2 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。
代码与模型权重按 Apache 2.0 记录;使用前仍应核对官方许可原文。
The checkpoint is listed under the Apache 2.0 license, with the license link included in the model references. Review the linked license text before commercial or derivative use.
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
