DataLearner 标志
GE

Gemini 3.1 Pro Preview

预览版多模态大模型Gemini ProGemini 3.1

Gemini 3.1 Pro Preview

发布时间: 2026-02-20更新于: 2026-09-18知识截止: 2025-01浏览量: 7,378
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
1M
多语言支持
支持
推理能力
4/5

Gemini 3.1 Pro Preview 是Google Deep Mind于 2026-02-20 发布的多模态大模型。支持文本、图像、视频、音频输入和文本输出,上下文窗口为 1M,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Gemini 3.1 Pro Preview

模型基本信息

推理过程
支持
思考模式
思考水平 · 高 (High) (默认)思考水平 · 低 (Low)
上下文长度
1M tokens
最大输出长度
64K tokens
模型类型
多模态大模型
输入/输出模态
文本、图像、音频、视频 → 文本
发布时间
2026-02-20
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
2025-01
Gemini 3.1 Pro Preview

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
Gemini 3.1 Pro Preview

官方介绍与博客

Gemini 3.1 Pro Preview

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本上下文长度 <= 200K$2.00/ 1M tokens$12.00/ 1M tokens
文本上下文长度 > 200K$4.00/ 1M tokens$18.00/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-—$0.200/ 1M tokens
上下文长度 <= 200K
文本-—$0.400/ 1M tokens
上下文长度 > 200K

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Gemini 3.1 Pro Preview

评测结果

Gemini 3.1 Pro Preview 当前已收录的代表性评测结果包括 GPQA Diamond(6 / 253,得分 94.30)、MMLU(3 / 124,得分 92.60)、MedCode(2 / 64,得分 59.06)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合知识考试

共 3 项评测
评测名称 / 模式
得分
排名/总数
MMLU
高
92.60
3 / 124
HLE
高
46.44
55 / 235
HLE
高工具
51.40
36 / 235

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
94.30
6 / 253
CritPt
思考模式
17.70
46 / 204

仓库修复与多文件工程

共 4 项评测
评测名称 / 模式
得分
排名/总数
80.60
11 / 116
54.20
37 / 62
SWE-Bench Pro - Commercial
思考模式工具
32.20
3 / 3
DeepSWE
高工具
11.73
90 / 92

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
高工具
91.70
4 / 125

抽象归纳与泛化

共 2 项评测
评测名称 / 模式
得分
排名/总数
77.10
44 / 181

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
1491.30
56 / 110

图像感知与视觉推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMMU-Pro
思考模式
82.40
22 / 229
MMMU
高
80.50
17 / 74

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
常规模式
79.60
9 / 96

客服与业务流程

共 6 项评测
评测名称 / 模式
得分
排名/总数
99.30
1 / 30
τ²-Bench
高工具
90.80
2 / 44
53.79
24 / 26
SAGE
高工具
48.68
19 / 64
τ³-Banking
思考模式工具
21.40
87 / 167
τ³-Banking
高工具
26.03
74 / 167

数学

共 5 项评测
评测名称 / 模式
得分
排名/总数
49
5 / 24
36.90
11 / 60
26
24 / 28
16.70
20 / 80
16.70
20 / 80

事实查找与深度检索

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
高工具联网
85.90
8 / 58

跨能力综合测试

共 1 项评测
评测名称 / 模式
得分
排名/总数
77.13
7 / 117

自主开发与终端任务

共 4 项评测
评测名称 / 模式
得分
排名/总数
68.50
8 / 48
65.84
46 / 57
Terminal Bench Hard
思考模式工具
53.80
16 / 244
Terminal-Bench 4.0
思考模式工具
4
70 / 98

多轮记忆与持续上下文

共 3 项评测
评测名称 / 模式
得分
排名/总数
75.70
49 / 126
84.73
25 / 126
EBR-bench
思考模式工具
14.29
14 / 23

桌面工作流

共 1 项评测
评测名称 / 模式
得分
排名/总数
OSWorld-Verified
思考模式工具
76.20
14 / 28

跨应用与工具编排

共 3 项评测
评测名称 / 模式
得分
排名/总数
Pinch Bench
思考模式工具
86.70
11 / 38
81.01
9 / 45
MCP-Atlas
高工具
78.20
17 / 44

跨能力聚合指数

共 3 项评测
评测名称 / 模式
得分
排名/总数

文档与图表理解

共 3 项评测
评测名称 / 模式
得分
排名/总数
CharXiv RQ
思考模式
83.30
17 / 19
CharXiv RQ
思考模式工具
83.20
18 / 19
GDP.pdf
思考模式
17.80
47 / 122

机器学习工程

共 2 项评测
评测名称 / 模式
得分
排名/总数
WeirdML v2
常规模式工具
72.10
17 / 52
MLE-Bench
思考模式工具
42.60
3 / 3

长文定位与检索

共 2 项评测
评测名称 / 模式
得分
排名/总数
84.90
3 / 8
26.30
3 / 3

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SciCode
思考模式
58.70
13 / 134

法律

共 3 项评测
评测名称 / 模式
得分
排名/总数
Harvey Lab-AA
思考模式工具
58.85
38 / 44
20.67
34 / 42

金融

共 2 项评测
评测名称 / 模式
得分
排名/总数
52.62
34 / 42
42.98
37 / 43

维护、优化与工程管理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GSO
常规模式工具
22.55
10 / 21
17.31
33 / 43

综合偏好评测

共 1 项评测
评测名称 / 模式
得分
排名/总数
1461.49
23 / 35

逻辑与规划

共 1 项评测
评测名称 / 模式
得分
排名/总数
BALROG
常规模式工具
57
2 / 12

能力边界度量

共 1 项评测
评测名称 / 模式
得分
排名/总数
METR Time Horizons v1.1
常规模式工具
384.15
2 / 22

专业数据分析

共 1 项评测
评测名称 / 模式
得分
排名/总数
AA-AnalystAgent
思考模式工具联网
41.25
12 / 29

程序生成与编辑

共 1 项评测
评测名称 / 模式
得分
排名/总数
32.03
42 / 61

临床工作与医疗决策

共 2 项评测
评测名称 / 模式
得分
排名/总数
MedScribe
高工具
76.11
52 / 66
MedCode
高工具
59.06
2 / 64

和其他模型对比

Gemini 3.1 Pro Preview

发布机构

Gemini 3.1 Pro Preview

模型解读

Gemini 3.1 Pro 是近期推出的 Gemini 3 系列新一代模型。该版本聚焦于逻辑推理、代码生成及智能体工作流优化,目前已通过公共预览版提供给开发者和企业用户。以下是基于最新技术规范的模型能力梳理。

一、 基础参数与逻辑基准
Gemini 3.1 Pro 支持文本、图像、视频、音频及PDF等多模态输入。其上下文窗口的输入上限设定为 1,048,576 个 Token,输出上限为 65,536 个 Token。
在评估模型解决未知逻辑模式能力的 ARC-AGI-2 基准测试中,Gemini 3.1 Pro 的得分为 77.1%,是上一代 Gemini 3 Pro 对应成绩的两倍。

二、 纯代码视觉与SVG动画生成
视觉生成逻辑的扩充是该版本的技术更新之一。Gemini 3.1 Pro 支持直接通过文本提示生成适用于 Web 环境的动画 SVG 文件。
与基于像素矩阵的光栅图像生成不同,该模型将视觉元素与动画轨迹转化为纯代码输出。这种生成方式具有两项客观特征:

  1. 无损缩放:输出的矢量图形支持任意比例缩放,能够适配不同分辨率屏幕而不损失清晰度。
  2. 轻量化:在呈现动态视觉效果时,其基于纯代码的结构使得文件体积显著小于常规的视频或 GIF 格式。
    在工程侧,模型能够解析复杂的矢量路径并输出标准化的 XML/SVG 代码。这些代码经过结构化处理,支持直接嵌入前端网页项目,或导入专业的矢量绘图软件进行二次编辑与拆解。

三、 智能体工作流与专属 API 节点
针对软件工程(SWE)任务,模型在 API 层面新增了名为 gemini-3.1-pro-preview-customtools 的独立端点。
该端点针对包含自定义工具调用(如 view_file、search_code)与 Bash 环境执行的自动化工作流进行了优化。在此机制下,模型在执行长周期代码任务前,能够输出包含架构规划与风险评估的完整链路方案。例如在处理数据库迁移指令时,模型会预先输出包含同步引擎与冲突解决策略的方案架构,随后再切入代码编写阶段。

四、 分发渠道
目前,Gemini 3.1 Pro 预览版已部署至多个产品线。开发者与企业用户可通过 Google AI Studio、Vertex AI、Gemini Enterprise、Android Studio 以及 Google Antigravity 开发平台进行接入。在消费端,该模型向订阅了 Google AI Pro 和 Ultra 计划的 Gemini 应用程序及 NotebookLM 用户开放。

总结
Gemini 3.1 Pro 的技术迭代集中于代码维度的结构化输出与逻辑推理。纯代码驱动的 SVG 动画生成以及专属工具 API 的引入,体现了该模型在前端开发视觉资源生成和自动化代码工程规划场景中的技术设定。

Gemini 3.1 Pro Preview

常见问题

Gemini 3.1 Pro Preview 是什么模型?

Gemini 3.1 Pro Preview 是Google Deep Mind于 2026-02-20 发布的多模态大模型。支持文本、图像、视频、音频输入和文本输出,上下文窗口为 1M,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

Gemini 3.1 Pro Preview 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像、视频、音频输入,并生成文本输出。

Gemini 3.1 Pro Preview 的上下文窗口和最大输出是多少?

上下文窗口为 1M,最大输出为 64K。未公开或无法确认的规格不做推测。

Gemini 3.1 Pro Preview 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言相关任务;实际效果应结合具体工作流验证。

Gemini 3.1 Pro Preview 是否提供 API,价格如何查看?

页面已收录 Google Deep Mind 的 4 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Gemini 3.1 Pro Preview 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码