Gemini 3.5 Flash-LitevsGemini 3.1 Flash-Lite
在 14 个共同 benchmark 中,Gemini 3.5 Flash-Lite 整体领先:Gemini 3.5 Flash-Lite 领先 11 项,Gemini 3.1 Flash-Lite 领先 3 项,持平 0 项,平均分差 +7.36。
Gemini 3.5 Flash-Lite
Google DeepMind · 2026-07-21 · 多模态大模型
Gemini 3.1 Flash-Lite
Google DeepMind · 2026-05-07 · 多模态大模型
Gemini 3.5 Flash-Lite11 项(79%)(21%)3 项Gemini 3.1 Flash-Lite
评测分数
按能力类目分组,每组内按分差大小排列;共 14 项。
临床工作与医疗决策
胶着 2/2| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| MedScribe | 70.8960 / 66Thinking High (With Tools) | 63.9065 / 66Thinking High (With Tools) | +6.99 |
| MedCode | 43.4933 / 64Thinking High (With Tools) | 47.6023 / 64Thinking High (With Tools) | -4.11 |
客服与业务流程
胶着 2/2| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| τ³-Banking | 17.50100 / 167Thinking (With Tools) | 9.70134 / 167Thinking (With Tools) | +7.80 |
| SAGE | 47.3025 / 64Thinking High (With Tools) | 49.5413 / 64Thinking High (With Tools) | -2.24 |
金融
Gemini 3.5 Flash-Lite 领先 2/2| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| EMB (Excel Modeling) | 43.2337 / 42Thinking High (With Tools) | 8.6342 / 42Thinking High (With Tools) | +34.60 |
| Finance Agent v2 | 47.4435 / 43Thinking High (With Tools) | 29.9942 / 43Thinking High (With Tools) | +17.45 |
图像感知与视觉推理
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| MMMU-Pro | 7951 / 229Thinking (No Tools) | 75.5083 / 229Thinking (No Tools) | +3.50 |
文档与图表理解
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| GDP.pdf | 13.6065 / 122Thinking (No Tools) | 7.8092 / 122Thinking (No Tools) | +5.80 |
法律
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| Legal Research Bench | 13.9436 / 42Thinking High (With Tools) | 3.3742 / 42Thinking High (With Tools) | +10.57 |
科学知识与推理
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| GPQA Diamond | 83.33102 / 253Thinking High (No Tools) | 81.82115 / 253Thinking High (No Tools) | +1.52 |
科学计算与科研编程
Gemini 3.1 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| SciCode | 41.30104 / 134Thinking (No Tools) | 43.4099 / 134Thinking (No Tools) | -2.10 |
维护、优化与工程管理
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| Code Migration | 6.1540 / 43Thinking High (With Tools) | 4.6142 / 43Thinking High (With Tools) | +1.54 |
自主开发与终端任务
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| Terminal-Bench 4.0 | 186 / 98Thinking (With Tools) | 0.5093 / 98Thinking (With Tools) | +0.50 |
跨能力聚合指数
Gemini 3.5 Flash-Lite 领先 1/1| 评测项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite | 分差 |
|---|---|---|---|
| Vals Index | 36.7136 / 42Thinking High (With Tools) | 15.4642 / 42Thinking High (With Tools) | +21.25 |
规格对比
| 字段 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite |
|---|---|---|
| 发布机构 | Google DeepMind | Google DeepMind |
| 发布时间 | 2026-07-21 | 2026-05-07 |
| 模型类型 | 多模态大模型 | 多模态大模型 |
| 架构 | 稠密模型 | 稠密模型 |
| 参数规模 | 暂无数据 | 暂无数据 |
| 上下文长度 | 1M | 1M |
| 最大输出 | 64K | 64K |
API 调用价格
价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。
| 价格项 | Gemini 3.5 Flash-Lite | Gemini 3.1 Flash-Lite |
|---|---|---|
| 文本输入 | $0.3 / 1M tokens | $0.25 / 1M tokens |
| 文本输出 | $2.5 / 1M tokens | $1.5 / 1M tokens |
| 缓存读取 | $0.03 / 1M tokens | $0.025 / 1M tokens |
小结
- Gemini 3.5 Flash-Lite在以下类目领先:金融 (2/2)、图像感知与视觉推理 (1/1)、文档与图表理解 (1/1)、法律 (1/1)、科学知识与推理 (1/1)、维护、优化与工程管理 (1/1)、自主开发与终端任务 (1/1)、跨能力聚合指数 (1/1)
- Gemini 3.1 Flash-Lite在以下类目领先:科学计算与科研编程 (1/1)
- 胶着类目:临床工作与医疗决策、客服与业务流程
14 个共同 benchmark 上,Gemini 3.5 Flash-Lite 平均高出 7.36 分。
单项差距最大的 benchmark:EMB (Excel Modeling) — Gemini 3.5 Flash-Lite 43.23,Gemini 3.1 Flash-Lite 8.63(分差 +34.60)。
本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。