QW
Qwen3-VL-8B-Thinking
发布时间: 2025-10-15更新于: 2026-09-18弃用: 2026-06-08预计下架: 2026-10-10浏览量: 812
模型参数
87.7亿
上下文长度
256K
多语言支持
暂无数据
推理能力
3/5
Qwen3-VL-8B-Thinking 是由 阿里巴巴 发布的 AI 模型,发布时间为 2025-10-15,定位为 推理大模型,参数规模约为 87.7亿,上下文长度为 256K,采用 Apache 2.0 许可。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
Qwen3-VL-8B-Thinking
模型基本信息
推理过程
支持
思考模式
常规模式 (默认)思考模式
上下文长度
256K tokens
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
文本、图像、视频 → 文本
发布时间
2025-10-15
模型文件大小
暂无数据
MoE架构
是
总参数 / 激活参数
87.7亿 / 88亿
知识截止
暂无数据
Qwen3-VL-8B-Thinking
开源和体验地址
Qwen3-VL-8B-Thinking
官方介绍与博客
DataLearnerAI博客
暂无
Qwen3-VL-8B-Thinking
API接口信息
接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | ¥0.0015/ 1K tokens | ¥0.015/ 1K tokens |
| 图像 | - | ¥0.0015/ 1K tokens | — |
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
Qwen3-VL-8B-Thinking
发布机构
阿里巴巴
查看发布机构详情 Qwen3-VL-8B-Thinking
模型解读
模型简介与发布
Qwen3-VL-8B-Thinking 为 Qwen3-VL 系列的中型推理增强多模态模型,于 2025-10-15 与 4B/8B Instruct/Thinking 同步发布。
架构与规格
- 参数规模:约 8.77B。
- 上下文:原生 256K,可扩展至 1M。
- 架构更新:Interleaved-MRoPE、DeepStack、多模态文本-时间戳对齐。
- 许可:Apache-2.0。
核心能力与模态
支持图像/视频输入与文本输出,覆盖 OCR(32 语种)、版面解析、复杂空间推理与长视频时序定位,以及“视觉代理”场景(GUI 元素识别、功能理解与步骤执行)。
访问方式
- GitHub:Qwen3-VL 代码与示例。
- Hugging Face:提供本模型权重与模型卡。
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
