DataLearner 标志

Qwen3.6-35B-A3BvsGemma 4 26B A4B

在 5 个共同 benchmark 中,Qwen3.6-35B-A3B 整体领先:Qwen3.6-35B-A3B 领先 5 项,Gemma 4 26B A4B 领先 0 项,持平 0 项,平均分差 +3.08。

阿里巴巴
Qwen3.6-35B-A3B

阿里巴巴 · 2026-04-16 · 推理大模型

Google DeepMind
Gemma 4 26B A4B

Google DeepMind · 2026-04-02 · 聊天大模型

Qwen3.6-35B-A3B5 项(100%)(0%)0 项Gemma 4 26B A4B

评测分数

按能力类目分组,每组内按分差大小排列;共 5 项。

图像感知与视觉推理

Qwen3.6-35B-A3B 领先 1/1
评测项Qwen3.6-35B-A3BGemma 4 26B A4B分差
MMMU-Pro71124 / 229Normal (No Tools)66.70148 / 229Normal (No Tools)+4.30

数学

Qwen3.6-35B-A3B 领先 1/1
评测项Qwen3.6-35B-A3BGemma 4 26B A4B分差
AIME 202692.7019 / 30Thinking (No Tools)88.3027 / 30Thinking (No Tools)+4.40

算法与竞赛编程

Qwen3.6-35B-A3B 领先 1/1
评测项Qwen3.6-35B-A3BGemma 4 26B A4B分差
LiveCodeBench80.4031 / 125Thinking (No Tools)77.1037 / 125Thinking (No Tools)+3.30

综合知识考试

Qwen3.6-35B-A3B 领先 1/1
评测项Qwen3.6-35B-A3BGemma 4 26B A4B分差
MMLU-Pro85.2026 / 175Thinking (No Tools)82.6051 / 175Thinking (No Tools)+2.60

自主开发与终端任务

Qwen3.6-35B-A3B 领先 1/1
评测项Qwen3.6-35B-A3BGemma 4 26B A4B分差
Terminal Bench Hard25.80126 / 244Normal (With Tools)25128 / 244Normal (With Tools)+0.80

规格对比

字段Qwen3.6-35B-A3BGemma 4 26B A4B
发布机构阿里巴巴Google DeepMind
发布时间2026-04-162026-04-02
模型类型推理大模型聊天大模型
架构MoE 架构MoE 架构
参数规模350亿252亿
上下文长度200K256K
最大输出80K32K

小结

  • Qwen3.6-35B-A3B在以下类目领先:图像感知与视觉推理 (1/1)、数学 (1/1)、算法与竞赛编程 (1/1)、综合知识考试 (1/1)、自主开发与终端任务 (1/1)

5 个共同 benchmark 上,Qwen3.6-35B-A3B 平均高出 3.08 分。

单项差距最大的 benchmark:AIME 2026 — Qwen3.6-35B-A3B 92.70,Gemma 4 26B A4B 88.30(分差 +4.40)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。