Gemini 3.1 Flash-Lite

gemini-3.1-flash-lite

Gemini 3.1 Flash Lite は、参照元で強調されている特徴として high-efficiency マルチモーダル model with text/image/video/audio/PDF 対応 を持ちます。主な価値は 抽出, ルーティング, 分類 and lightweight マルチモーダル agents にあります。そのため、汎用チャットモデルとしてではなく、このモデル固有の強みを中心に説明するのが自然です。

Context Window

1M tokens

Maximum Output

65.5K tokens

Release Date

2026年5月7日

Modalities

Gemini 3.1 Flash-Lite の料金

入力価格出力価格キャッシュ読み取りキャッシュ作成 5m
$0.25/M$1.5/M$0.025/M$0.0833/M

Gemini 3.1 Flash-Lite の API 機能

Reasoning

Supported

Tool calling

Supported

Temperature parameter

Supported

Attachments

Supported

Knowledge Base

2025-01-01

Endpoint Protocols

Completions API

Gemini 3.1 Flash-Liteのモデル特長

Gemini 3.1 Flash-Liteは、低遅延のマルチモーダル処理、長文脈、軽量な推論を組み合わせ、高頻度かつ大量の処理に適しています。

低遅延処理

応答時間と運用コストが重視される、明確で高頻度なリクエストを効率よく処理します。

大規模マルチモーダル処理

テキスト、画像、動画、音声、PDFを入力として、大規模な分類、抽出、変換処理に対応します。

設定可能な軽量推論

単純なタスクで精度を高めたい場合に、大型モデルへ切り替えず追加の推論を割り当てられます。

Gemini 3.1 Flash-Liteのユースケース

Gemini 3.1 Flash-Liteは、一括翻訳、マルチメディア文字起こし、構造化抽出やモデルルーティングに適しています。

一括翻訳

大量のチャット、レビュー、サポートチケットを、簡潔な出力形式を保ちながら翻訳します。

マルチメディア文字起こし

録音、音声メモ、動画内の発話を、別の音声認識処理なしで検索可能なテキストへ変換します。

構造化ルーティング

リクエストを分類し、定義済みスキーマへエンティティを抽出して、適切な後続処理へ振り分けます。

TokenHub API で Gemini 3.1 Flash-Lite を使用する方法

Create API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

Gemini 3.1 Flash-Lite のベンチマーク

Gemini 3.1 Flash-Lite

指数スコア
Artificial Analysis Intelligence Index総合能力の集約評価25
Artificial Analysis Coding Indexコーディング能力の集約評価30.1
知識と推論
GPQA高度な科学問題の解決82.2%
HLE幅広い分野の専門家レベル試験16.2%
コーディングとソフトウェア開発
SciCode科学計算のコーディング課題41.9%
Terminal-Bench Hard高難度のターミナル操作24.2%
指示追従とエージェントタスク
IFBenchプロンプト制約への準拠77.2%
AA-LCR長いコンテキストでの推論65.3%
τ²-Benchエージェントのワークフロータスク31.3%

指標の出典 Artificial Analysis

メディアと議論

このモデルに関連する公開動画と投稿を選んでいます。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

Gemini 3.1 Flash-Lite に関するよくある質問

Gemini 3.1 Flash-Lite の位置づけ、適した用途、主な強み、注意点、TokenHub で安全に利用するための確認事項を紹介します。

Gemini 3.1 Flash-Lite は提供元のモデル系列でどの位置にありますか?+

Gemini 3.1 Flash-Lite は、高頻度の軽量マルチモーダル処理向けに低遅延・低コストを重視した Google Gemini 3 系モデルです。提供元の公開ドキュメントに掲載される現行モデルですが、利用可否はプラットフォームによって異なります。

Gemini 3.1 Flash-Lite に適した本番ユースケースは何ですか?+

大規模な分類と振り分け、単純な構造化データ抽出、および大量翻訳に適しています。本番導入前に代表的な入力でテストし、測定可能な合格基準を定めてください。

Gemini 3.1 Flash-Lite は単純な構造化データ抽出で何が際立っていますか?+

実用上の主な強みは応答の速さ、コスト効率のよいスケーリング、および多様なマルチモーダル入力への対応です。この組み合わせは、単純な構造化データ抽出で特に価値があります。

Gemini 3.1 Flash-Lite を使う際に考慮すべきトレードオフは何ですか?+

最上位 Pro クラスの推論が必要な場合、繊細な長文生成や難しい推論が必要な場合、または重要な判断に人手レビューを入れられない場合は、別のモデルも検討してください。事実、法務、財務、医療、運用に関わる重要な出力は、適切な専門知識を持つ人が確認してください。

TokenHub で Gemini 3.1 Flash-Lite を安全に使い始めるにはどうすればよいですか?+

TokenHub では、Gemini 3.1 Flash-Lite に表示される正確なモデル識別子を選び、アカウント資料に記載されたエンドポイントと TokenHub 認証情報を使用してください。Gemini API と完全に同じだと想定せず、TokenHub で提供される入力形式、ツール、グラウンディング機能、モデルのライフサイクルを確認してください。

Gemini 3.1 Flash-Lite を使い始めますか?

1つの API キーで Gemini 3.1 Flash-Lite とその他の AI モデルにアクセスできます。

API キーを作成