DataLearner 标志
GE

Gemini 2.5 Flash-Lite

推理大模型Gemini Flash-LiteGemini 2.5

Gemini 2.5 Flash-Lite

发布时间: 2025-06-17更新于: 2025-06-18浏览量: 1,474
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
1024K
多语言支持
支持
推理能力
3/5

Gemini 2.5 Flash-Lite 是由 Google DeepMind 发布的 AI 模型,发布时间为 2025-06-17,定位为 推理大模型,上下文长度为 1024K,采用 不开源 许可,在 MMLU 上取得 84.50 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Gemini 2.5 Flash-Lite

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
1024K tokens
最大输出长度
64K tokens
模型类型
推理大模型
输入/输出模态
文本、图像、音频、视频 → 文本
发布时间
2025-06-17
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
Gemini 2.5 Flash-Lite

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
Gemini 2.5 Flash-Lite

官方介绍与博客

DataLearnerAI博客
暂无
Gemini 2.5 Flash-Lite

API接口信息

接口速度
4/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$0.100/ 1M tokens$0.400/ 1M tokens
图像-$0.100/ 1M tokens—
音频-$0.300/ 1M tokens—
视频-$0.100/ 1M tokens—
批量模式
类型适用条件输入输出
文本-$0.050/ 1M tokens$0.200/ 1M tokens
图像-$0.050/ 1M tokens—
视频-$0.050/ 1M tokens—
缓存定价Prompt缓存
类型有效期写入读取
文本-—$0.010/ 1M tokens
图像-—$0.010/ 1M tokens
音频-—$0.030/ 1M tokens
视频-—$0.010/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Gemini 2.5 Flash-Lite

评测结果

Gemini 2.5 Flash-Lite 当前已收录的代表性评测结果包括 MMLU(45 / 124,得分 84.50)、GPQA Diamond(194 / 253,得分 66.70)、AIME2025(87 / 110,得分 63.10)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
84.50
45 / 124
HLE
常规模式
6.90
215 / 235

科学知识与推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
66.70
194 / 253

事实可靠性与幻觉

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleQA
常规模式
13
38 / 46

仓库修复与多文件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
常规模式
27.60
113 / 116

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
34.30
113 / 125

数学

共 1 项评测
评测名称 / 模式
得分
排名/总数
AIME2025
常规模式
63.10
87 / 110

跨能力综合测试

共 1 项评测
评测名称 / 模式
得分
排名/总数
42.56
109 / 117

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
Terminal Bench Hard
常规模式工具
2.30
229 / 244
Terminal Bench Hard
思考模式工具
4.50
214 / 244

图像感知与视觉推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMMU-Pro
常规模式
54
192 / 229
MMMU-Pro
思考模式
58.20
183 / 229
Gemini 2.5 Flash-Lite

发布机构

Gemini 2.5 Flash-Lite

模型解读

Gemini 2.5 Flash-Lite 是 Gemini 2.5 系列模型中最新发布的预览版本,以其高性价比和卓越的速度为特点。该模型在编码、数学、科学、推理和多模态基准测试中均展现出比 Gemini 2.0 Flash-Lite 更高的综合质量。特别是在处理大规模、对延迟敏感的任务,如翻译和分类时,Gemini 2.5 Flash-Lite 的表现尤为突出,其延迟低于 Gemini 2.0 Flash-Lite 和 Gemini 2.0 Flash。

Gemini 2.5 Flash-Lite 继承了 Gemini 2.5 系列的核心能力,包括灵活调整计算预算以实现不同程度的思考能力,支持连接 Google Search 等工具以及代码执行,并具备多模态输入和高达一百万 token 的上下文长度。

目前,Gemini 2.5 Flash-Lite 的预览版本已在 Google AI Studio 和 Vertex AI 上线,用户可以开始构建应用并提供反馈。同时,Gemini 2.5 Flash 和 Pro 的稳定版本也已正式发布,可供生产环境使用,并已集成到 Gemini 应用中。此外,Gemini 2.5 Flash-Lite 和 Flash 的定制版本也已应用于 Google Search。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码