DataLearner 标志

Qwen3.5-35B-A3B 评测详情

Qwen3.5-35B-A3B 当前已收录的代表性评测结果包括 Claw Bench(8 / 29,得分 91.40)、MMMU-Pro(115 / 229,得分 72.70)、Terminal Bench Hard(123 / 244,得分 26.50)。

评测结果

Qwen3.5-35B-A3B

评测结果

思考模式
工具使用

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
Terminal Bench Hard
常规模式工具
10.60
182 / 244
Terminal Bench Hard
思考模式工具
26.50
123 / 244

多轮记忆与持续上下文

共 2 项评测
评测名称 / 模式
得分
排名/总数
Context Arena
常规模式
33.10
111 / 126
Context Arena
思考模式
67.48
68 / 126

跨应用与工具编排

共 2 项评测
评测名称 / 模式
得分
排名/总数
Claw Bench
思考模式工具
91.40
8 / 29
Pinch Bench
思考模式工具
78.40
27 / 38

跨长文理解与整合

共 1 项评测
评测名称 / 模式
得分
排名/总数
LongBench v2
常规模式
59
10 / 14

图像感知与视觉推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMMU-Pro
常规模式
69.20
134 / 229
MMMU-Pro
思考模式
72.70
115 / 229

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
CritPt
常规模式
0.60
172 / 204
CritPt
思考模式
0.90
162 / 204

客服与业务流程

共 1 项评测
评测名称 / 模式
得分
排名/总数
τ³-Banking
常规模式工具
4.90
158 / 167

跨能力聚合指数

共 1 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
142.52
86 / 167