Gemini 3.6 Flash
最大上下文
1M
最大输出
65.5K
发布日期
暂无
gemini-2.5-flashGemini 2.5 Flash 是 Gemini 2.5 系列中平衡价格与性能的模型,将 thinking 能力与较低延迟和成本结合起来。Google 资料将它定位在 Pro 的深度能力和 Flash-Lite 的效率之间。它适合需要推理、多模态输入和实际吞吐量的生产任务。
上下文窗口
1M Token
最大输出
65.5K Token
发布日期
2025年6月17日
模态
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $0.3/M | $2.5/M | $0.03/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
Gemini 2.5 Flash 结合自适应推理、多模态理解和大上下文窗口,适合要求快速响应的大规模工作负载。
模型可在任务需要进一步分析时进行思考,在推理深度与响应速度之间取得平衡。
模型可接收文本、图像、视频和音频,让开发者使用同一模型分析多种媒体信息。
1,048,576 token 的输入窗口可处理大型文档、媒体集合以及汇总后的应用上下文。
Gemini 2.5 Flash 适合大规模内容处理、多模态分析以及仍需一定推理能力的交互式应用。
结合文本分析图像、录音和视频,生成可检索的摘要、分类结果与信息提取结果。
对大量内容进行分类、摘要和信息提取,并在处理较复杂情况时保留必要的推理能力。
构建响应迅速的助手,用于理解用户内容、分析请求并以较低的感知延迟返回实用文本。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| 指数分数 | ||
|---|---|---|
| Artificial Analysis 综合能力指数 | Artificial Analysis 综合能力评分 | 14.1 |
| Artificial Analysis 代码能力指数 | Artificial Analysis 软件任务评分 | 17.8 |
| Artificial Analysis 数学能力指数 | Artificial Analysis 数学推理评分 | 60.3 |
| 知识与推理 | ||
| MMLU-Pro | 高难度多任务知识评测 | 80.9% |
| GPQA | 高阶科学问题求解 | 68.3% |
| HLE | 广泛专家级考试集合 | 5.1% |
| 代码与工程 | ||
| LiveCodeBench | 近期编程题评测 | 49.5% |
| SciCode | 科学计算代码挑战 | 29.1% |
| Terminal-Bench Hard | 高难度终端任务执行 | 12.1% |
| 数学能力 | ||
| MATH-500 | 高难度数学解题 | 93.2% |
| AIME | 数学竞赛题 | 50% |
| AIME 2025 | 数学竞赛题 | 60.3% |
| 指令遵循与 Agent 任务 | ||
| IFBench | 指令约束遵循 | 39.0% |
| AA-LCR | 长上下文推理 | 45.9% |
| τ²-Bench | Agent 工作流任务 | 14.9% |
指标来源 Artificial Analysis
了解 Gemini 2.5 Flash 的定位、适合处理的任务、主要优势、使用限制,以及在 TokenHub 中接入时需要注意的事项。
Gemini 2.5 Flash 是 Google 的均衡型 Gemini 2.5 Flash,适合仍需一定推理能力的高并发、低延迟任务。它仍是明确的模型版本,但新项目评估时通常也应比较同系列更新型号。
它适合高并发应用请求、可靠执行多步骤智能体流程以及文本与图像输入分析。上线前应使用有代表性的输入进行测试,并制定可衡量的验收标准。
它最实用的优势包括质量、速度与成本的良好平衡、较快的响应速度以及对难题的较强推理能力。这些特点对可靠执行多步骤智能体流程尤其有价值。
如果任务需要最强的 Pro 级推理、项目可以采用更新一代 Gemini,或重要决策流程无法安排人工复核,可以考虑其他模型。涉及事实、法律、财务、医疗或运营的重要结果,应由具备相关资质的人员复核。
在 TokenHub 中,请选择页面显示的 Gemini 2.5 Flash 精确模型标识,使用账号文档中指定的接口,并通过 TokenHub 凭证完成认证。请确认 TokenHub 实际开放的输入类型、工具、信息依据选项和模型生命周期,不要默认与 Gemini API 完全一致。
通过一个 API Key 接入 Gemini 2.5 Flash 与更多 AI 模型。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit
YouTube