Gemini 3.1 Flash-Lite

gemini-3.1-flash-lite

Gemini 3.1 Flash Lite 是 Gemini 3.1 家族中更高效率的多模态模型。模型卡描述其低延遲、高吞吐,并支援文字、圖片、影片、音频和 PDF,以及輕量 Agent 任務。它適合信息擷取、分類、路由和生產级多模态高頻任務。

上下文視窗

1M Token

最大輸出

65.5K Token

發布日期

2026年5月7日

模態

Gemini 3.1 Flash-Lite 價格

輸入價格輸出價格快取讀取快取建立 5m
$0.25/M$1.5/M$0.025/M$0.0833/M

Gemini 3.1 Flash-Lite API 能力

推理

支援

工具呼叫

支援

Temperature 參數

支援

附件

支援

知識庫

2025-01-01

Endpoint 協議

Completions API

Gemini 3.1 Flash-Lite 模型亮點

Gemini 3.1 Flash-Lite 結合低延遲多模態處理、長內容脈絡與輕量推理能力,適合高頻率、大批量工作負載。

低延遲處理

可高效率處理直接且高頻率的請求,適用於回應時間與運作成本受到嚴格限制的情境。

大批量多模態處理

可接收文字、影像、影片、音訊與 PDF,用於規模化分類、擷取與轉換流程。

可設定輕量推理

當簡單工作需要更高準確度時,可增加推理投入而不必切換至更大型模型。

Gemini 3.1 Flash-Lite 使用情境

Gemini 3.1 Flash-Lite 適合批量翻譯、多媒體轉錄,以及結構化擷取或模型路由流程。

批量翻譯

批量翻譯聊天訊息、評論或客服案件,同時維持精簡的輸出格式。

多媒體轉錄

將錄音、語音筆記或影片語音轉換為可搜尋文字,不需另外建立語音辨識流程。

結構化路由流程

分類請求、依指定結構擷取實體,並將每個項目導向合適的後續流程。

如何透過 TokenHub API 使用 Gemini 3.1 Flash-Lite

建立 API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

Gemini 3.1 Flash-Lite 基準測試

Gemini 3.1 Flash-Lite

指數分數
Artificial Analysis 綜合能力指數Artificial Analysis 綜合能力評分25
Artificial Analysis 程式碼能力指數Artificial Analysis 軟體任務評分30.1
知識與推理
GPQA高階科學問題求解82.2%
HLE廣泛專家級考試集合16.2%
程式碼與工程
SciCode科學計算程式碼挑戰41.9%
Terminal-Bench Hard高難度終端任務執行24.2%
指令遵循與 Agent 任務
IFBench指令約束遵循77.2%
AA-LCR長上下文推理65.3%
τ²-BenchAgent 工作流程任務31.3%

指標來源 Artificial Analysis

媒體與討論

精選與此模型相關的公開影片和貼文。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

Gemini 3.1 Flash-Lite 常見問題

了解 Gemini 3.1 Flash-Lite 的定位、適合的使用情境、主要優勢、使用限制,以及在 TokenHub 中串接時要注意的事項。

Gemini 3.1 Flash-Lite 在供應商的模型系列中位於什麼位置?+

Gemini 3.1 Flash-Lite 是 Google Gemini 3 系列中適合高頻輕量多模態工作的低延遲、低成本模型。它是供應商文件中的現行公開模型,但不同平台的可用情況可能不同。

哪些正式環境情境適合 Gemini 3.1 Flash-Lite?+

它適合大規模分類與路由、簡單的結構化資料擷取以及大量翻譯。正式上線前應使用具代表性的輸入測試,並訂定可衡量的驗收標準。

Gemini 3.1 Flash-Lite 在簡單的結構化資料擷取方面有何突出之處?+

它最實用的優勢包括較快的回應速度、良好的成本效益以及支援多種多模態輸入。這些特點對簡單的結構化資料擷取尤其有價值。

使用 Gemini 3.1 Flash-Lite 時需要注意哪些限制?+

如果工作需要最強的 Pro 級推理、工作需要細膩的長篇生成或高難度推理,或重要決策流程無法安排人工覆核,可以考慮其他模型。涉及事實、法律、財務、醫療或營運的重要結果,應由具備相關資格的人員覆核。

團隊該如何在 TokenHub 中穩妥地開始使用 Gemini 3.1 Flash-Lite?+

在 TokenHub 中,請選擇頁面顯示的 Gemini 3.1 Flash-Lite 精確模型識別碼,使用帳戶文件中指定的介面,並以 TokenHub 憑證完成驗證。請確認 TokenHub 實際開放的輸入類型、工具、資料依據選項與模型生命週期,不要預設與 Gemini API 完全相同。

準備呼叫 Gemini 3.1 Flash-Lite?

透過一個 API Key 接入 Gemini 3.1 Flash-Lite 與更多 AI 模型。

建立 API Key