Gemini 2.5 Flash

gemini-2.5-flash

Gemini 2.5 Flash 是 Gemini 2.5 系列中平衡价格与性能的模型,将 thinking 能力与较低延遲和成本结合起来。Google 資料将它定位在 Pro 的深度能力和 Flash-Lite 的效率之间。它適合需要推理、多模态輸入和实际吞吐量的生產任務。

上下文視窗

1M Token

最大輸出

65.5K Token

發布日期

2025年6月17日

模態

Gemini 2.5 Flash 價格

輸入價格輸出價格快取讀取
$0.3/M$2.5/M$0.03/M

Gemini 2.5 Flash API 能力

推理

支援

工具呼叫

支援

Temperature 參數

支援

附件

支援

知識庫

2025-01-01

Endpoint 協議

Completions APIMessages APIgemini

Gemini 2.5 Flash 模型亮點

Gemini 2.5 Flash 結合自適應推理、多模態理解與大型內容脈絡視窗,適合重視回應速度的大量工作負載。

自適應推理

模型可在任務需要進一步分析時進行思考,兼顧推理深度與回應速度。

多模態理解

模型可接收文字、圖片、影片與音訊,讓開發者透過同一模型分析多種媒體內容。

長內容脈絡處理

1,048,576 token 的輸入視窗可處理大型文件、媒體集合,以及整合後的應用程式內容脈絡。

Gemini 2.5 Flash 使用情境

Gemini 2.5 Flash 適合大量內容處理、多模態分析,以及仍需推理能力的互動式應用。

多媒體分析

結合文字分析圖片、錄音與影片,產出可搜尋的摘要、分類結果及擷取資訊。

大量內容處理

針對大量內容進行分類、摘要與資訊擷取,並在處理較複雜情況時保留必要的推理能力。

互動式助理

建置回應快速的助理,用來理解使用者內容、分析需求,並以較低的感受延遲提供實用文字回應。

如何透過 TokenHub API 使用 Gemini 2.5 Flash

建立 API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

Gemini 2.5 Flash 基準測試

指數分數
Artificial Analysis 綜合能力指數Artificial Analysis 綜合能力評分14.1
Artificial Analysis 程式碼能力指數Artificial Analysis 軟體任務評分17.8
Artificial Analysis 數學能力指數Artificial Analysis 數學推理評分60.3
知識與推理
MMLU-Pro高難度多任務知識評測80.9%
GPQA高階科學問題求解68.3%
HLE廣泛專家級考試集合5.1%
程式碼與工程
LiveCodeBench近期程式題評測49.5%
SciCode科學計算程式碼挑戰29.1%
Terminal-Bench Hard高難度終端任務執行12.1%
數學能力
MATH-500高難度數學解題93.2%
AIME數學競賽題50%
AIME 2025數學競賽題60.3%
指令遵循與 Agent 任務
IFBench指令約束遵循39.0%
AA-LCR長上下文推理45.9%
τ²-BenchAgent 工作流程任務14.9%

指標來源 Artificial Analysis

媒體與討論

精選與此模型相關的公開影片和貼文。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

Gemini 2.5 Flash 常見問題

了解 Gemini 2.5 Flash 的定位、適合的使用情境、主要優勢、使用限制,以及在 TokenHub 中串接時要注意的事項。

開發者該如何理解 Gemini 2.5 Flash 的角色?+

Gemini 2.5 Flash 是 Google 的均衡型 Gemini 2.5 Flash,適合仍需要推理能力的高用量、低延遲工作。它仍是明確的模型版本,但新專案評估時通常也應比較同系列較新型號。

在哪些情境下,Gemini 2.5 Flash 最能發揮實際價值?+

它適合高用量應用請求、可靠執行多步驟代理流程以及文字與影像輸入分析。正式上線前應使用具代表性的輸入測試,並訂定可衡量的驗收標準。

Gemini 2.5 Flash 最實用的特點有哪些?+

它最實用的優勢包括品質、速度與成本的良好平衡、較快的回應速度以及處理難題時的強大推理能力。這些特點對可靠執行多步驟代理流程尤其有價值。

Gemini 2.5 Flash 有哪些實際限制?+

如果工作需要最強的 Pro 級推理、專案可採用較新一代 Gemini,或重要決策流程無法安排人工覆核,可以考慮其他模型。涉及事實、法律、財務、醫療或營運的重要結果,應由具備相關資格的人員覆核。

如何在 TokenHub 中呼叫 Gemini 2.5 Flash?+

在 TokenHub 中,請選擇頁面顯示的 Gemini 2.5 Flash 精確模型識別碼,使用帳戶文件中指定的介面,並以 TokenHub 憑證完成驗證。請確認 TokenHub 實際開放的輸入類型、工具、資料依據選項與模型生命週期,不要預設與 Gemini API 完全相同。

準備呼叫 Gemini 2.5 Flash?

透過一個 API Key 接入 Gemini 2.5 Flash 與更多 AI 模型。

建立 API Key