Gemini 3.5 Pro 发布了吗?
本条目建立时尚未正式发布,内容为泄露信息存档。不过同系列的 Gemini 3.5 Flash(2026-06-20)与 Gemini 3.5 Flash-Lite(2026-07-21)都已经正式发布并有完整官方规格。如果你要选型,建议直接看这两个条目。
Gemini 3.5 Pro 是 Google 在 2026 年 5 月 19 日 I/O 上正式宣布、但至今仍未发布的 Pro 档旗舰。Google 当时称它「已在内部使用,下个月推出」,此后连续错过 6 月、7 月中和 8 月初三个窗口:6 月底的训练数据更新未达预期,Bloomberg 于 7 月 16 日报道其编程能力未能满足内部性能目标;7 月 21 日 Google 改为发布 3.6 Flash、3.5 Flash-Lite 和 Flash Cyber,8 月 13 日又直接发布了 3.7 Flash,Pro 线却仍停留在 2026 年 2 月的上一次更新。DeepMind 模型页至今标注 coming soon,没有模型 ID、定价和发布日期。流传的「Cappuccino」代号、200 万上下文、Deep Think 模式等说法均未获官方确认,故本条目规格、价格与评测字段一律留空。需要现在选型的话,实际可用的是已 GA 的 Gemini 3.7 Flash、3.6 Flash 与 3.5 Flash-Lite。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
Gemini 3.5 Pro 的特殊之处在于:它不是一条来路不明的小道消息,而是 Google 亲口宣布过、却连续跳票三次至今仍未发布的模型。2026 年 5 月 19 日的 Google I/O 上,Google DeepMind 正式介绍了 Gemini 3.5 系列,并明确表示 Pro 版本「已经在内部使用中,我们期待下个月把它推出来」——也就是指向 2026 年 6 月。
截至本页最后更新(2026 年 8 月),这个「下个月」已经过去了三个月。DeepMind 官方模型页上,Gemini 3.5 Pro 仍然只挂着「coming soon」,没有模型 ID、没有定价、没有发布日期。
值得注意的是版本号的错位:Flash 线已经走到 3.7,而 Pro 线还卡在 3.5 没发。这本身就说明 Pro 的延期不是排期问题,而是能力没达标。
发布前流传的说法包括:代号「Cappuccino」、上下文窗口可能翻倍到 200 万 tokens、引入所谓「系统 2 思维(System 2 Reasoning)」与 Deep Think 模式、原生支持 MCP 第三方工具接入,以及把独立的 Thinking 模式改为 Standard / Extended 两档全局开关。更早还有代号「Snow Bunny」的内部版本泄露,声称能一次性生成 3000 行可运行代码。
这些都没有得到 Google 任何确认,且其中部分说法在 Flash 线陆续发布后已经被现实修正(例如 3.5 Flash 的实际上下文是 1,048,576 tokens,并非 200 万)。因此本条目的参数量、上下文窗口、价格与评测字段一律留空,不做推测填充。
如果你在为项目挑 Gemini 系列的模型,实际可用的选择是已经 GA 的那几个,规格与价格都有官方来源:
换句话说,Gemini 当前的实际主力是 Flash 线,Pro 线的空缺已经持续了半年(上一次 Pro 更新还是 2026 年 2 月)。本条目会在 Google 正式发布后按官方资料重写。
本条目建立时尚未正式发布,内容为泄露信息存档。不过同系列的 Gemini 3.5 Flash(2026-06-20)与 Gemini 3.5 Flash-Lite(2026-07-21)都已经正式发布并有完整官方规格。如果你要选型,建议直接看这两个条目。
两个泄露的内部代号。Cappuccino 是 2026 年 5 月 15 日左右在 X 上曝光的 Gemini 3.5 Pro 代号;Snow Bunny 是 2026 年 1 月泄露的更早期内部测试版本,据称展现了一次性生成 3000 行可运行代码的能力。这类代号从未被 Google 官方确认。
泄露信息称版本号确实从传闻的 3.2 跳级至 3.5,但没有给出原因。从实际发布情况看这个跳级是成立的——Gemini 3.5 Flash 于 2026 年 6 月 20 日发布,而 Gemini 3.2 Flash 始终停留在灰度测试阶段未正式发布。
泄露信息描述的两项推理机制:System 2 Reasoning 指模型在回答前进行深度思考,Deep Think 是应对复杂逻辑推理任务的专门模式。同时思维模式的形态发生变化——从独立的 Thinking 模式改为全局开关,分 Standard(适合大多数问题)和 Extended(求解复杂问题)两档。已发布的 Gemini 3.5 / 3.6 / 3.7 Flash 采用的是 low / medium / high 三档 thinking level,与泄露描述不完全一致。
没有确切公开信息,本站不填写。参数量、上下文窗口长度和训练数据构成在泄露信息中均未涉及。作为参照,同系列已发布的 Gemini 3.5 Flash 输入上下文为 1,048,576 tokens、最大输出 65,536 tokens。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
