Gemini 2.5 Flash

gemini-2.5-flash

Gemini 2.5 Flash 是 Gemini 2.5 系列中平衡价格与性能的模型,将 thinking 能力与较低延迟和成本结合起来。Google 资料将它定位在 Pro 的深度能力和 Flash-Lite 的效率之间。它适合需要推理、多模态输入和实际吞吐量的生产任务。

上下文窗口

1M Token

最大输出

65.5K Token

发布日期

2025年6月17日

模态

Gemini 2.5 Flash 价格

输入价格输出价格缓存读取
$0.3/M$2.5/M$0.03/M

Gemini 2.5 Flash API 能力

推理

支持

工具调用

支持

Temperature 参数

支持

附件

支持

知识库

2025-01-01

Endpoint 协议

Completions APIMessages APIgemini

Gemini 2.5 Flash 模型亮点

Gemini 2.5 Flash 结合自适应推理、多模态理解和大上下文窗口,适合要求快速响应的大规模工作负载。

自适应推理

模型可在任务需要进一步分析时进行思考,在推理深度与响应速度之间取得平衡。

多模态理解

模型可接收文本、图像、视频和音频,让开发者使用同一模型分析多种媒体信息。

长上下文处理

1,048,576 token 的输入窗口可处理大型文档、媒体集合以及汇总后的应用上下文。

Gemini 2.5 Flash 使用场景

Gemini 2.5 Flash 适合大规模内容处理、多模态分析以及仍需一定推理能力的交互式应用。

多媒体分析

结合文本分析图像、录音和视频,生成可检索的摘要、分类结果与信息提取结果。

批量内容处理

对大量内容进行分类、摘要和信息提取,并在处理较复杂情况时保留必要的推理能力。

交互式助手

构建响应迅速的助手,用于理解用户内容、分析请求并以较低的感知延迟返回实用文本。

如何通过 TokenHub API 使用 Gemini 2.5 Flash

创建 API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

Gemini 2.5 Flash 基准测试

指数分数
Artificial Analysis 综合能力指数Artificial Analysis 综合能力评分14.1
Artificial Analysis 代码能力指数Artificial Analysis 软件任务评分17.8
Artificial Analysis 数学能力指数Artificial Analysis 数学推理评分60.3
知识与推理
MMLU-Pro高难度多任务知识评测80.9%
GPQA高阶科学问题求解68.3%
HLE广泛专家级考试集合5.1%
代码与工程
LiveCodeBench近期编程题评测49.5%
SciCode科学计算代码挑战29.1%
Terminal-Bench Hard高难度终端任务执行12.1%
数学能力
MATH-500高难度数学解题93.2%
AIME数学竞赛题50%
AIME 2025数学竞赛题60.3%
指令遵循与 Agent 任务
IFBench指令约束遵循39.0%
AA-LCR长上下文推理45.9%
τ²-BenchAgent 工作流任务14.9%

指标来源 Artificial Analysis

媒体与讨论

精选与此模型相关的公开视频和帖子。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

关于 Gemini 2.5 Flash 的常见问题

了解 Gemini 2.5 Flash 的定位、适合处理的任务、主要优势、使用限制,以及在 TokenHub 中接入时需要注意的事项。

开发者该如何理解 Gemini 2.5 Flash 的定位?+

Gemini 2.5 Flash 是 Google 的均衡型 Gemini 2.5 Flash,适合仍需一定推理能力的高并发、低延迟任务。它仍是明确的模型版本,但新项目评估时通常也应比较同系列更新型号。

在哪些场景下,Gemini 2.5 Flash 最能发挥实际价值?+

它适合高并发应用请求、可靠执行多步骤智能体流程以及文本与图像输入分析。上线前应使用有代表性的输入进行测试,并制定可衡量的验收标准。

Gemini 2.5 Flash 最实用的特点有哪些?+

它最实用的优势包括质量、速度与成本的良好平衡、较快的响应速度以及对难题的较强推理能力。这些特点对可靠执行多步骤智能体流程尤其有价值。

Gemini 2.5 Flash 有哪些实际限制?+

如果任务需要最强的 Pro 级推理、项目可以采用更新一代 Gemini,或重要决策流程无法安排人工复核,可以考虑其他模型。涉及事实、法律、财务、医疗或运营的重要结果,应由具备相关资质的人员复核。

如何在 TokenHub 中调用 Gemini 2.5 Flash?+

在 TokenHub 中,请选择页面显示的 Gemini 2.5 Flash 精确模型标识,使用账号文档中指定的接口,并通过 TokenHub 凭证完成认证。请确认 TokenHub 实际开放的输入类型、工具、信息依据选项和模型生命周期,不要默认与 Gemini API 完全一致。

准备调用 Gemini 2.5 Flash?

通过一个 API Key 接入 Gemini 2.5 Flash 与更多 AI 模型。

创建 API Key