/v1/chat/completionsGemini 3.6 Flash
gemini-3.6-flashGemini 3.6 Flash 是来自 Google 的高效模型,适用于编码、智能代理工作流以及网络和应用开发。它旨在生成精炼的输出,减少不必要的编辑和模棱两可的表述,同时降低完成任务所需的 Token 使用量和模型调用次数。
最大上下文
1MToken
最大输出
65.5KToken
发布日期
2026年7月21日
模态
Gemini 3.6 Flash 价格
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $1.5/M | $7.5/M | $0.15/M |
如何通过 API 使用 Gemini 3.6 Flash?
/v1/messagesGemini 3.6 Flash 基准测试
Gemini 3.6 Flash (high)
50.1
/100
Artificial Analysis 综合能力指数
Artificial Analysis 综合能力评分
指数分数
69.2
/100
Artificial Analysis 代码能力指数
Artificial Analysis 软件任务评分
指数分数
知识与推理
GPQA
高阶科学问题求解
92.8%
HLE
广泛专家级考试集合
38.3%
代码与工程
SciCode
科学计算代码挑战
52.7%
指令遵循与 Agent 任务
AA-LCR
长上下文推理
69.7%
指标来源 Artificial Analysis
Gemini 3.6 Flash 常见问题
关于在 TokenHub 使用 Gemini 3.6 Flash 的实用问答。
gemini-3.6-flash 是什么?+
gemini-3.6-flash 是 Google 的稳定版 Gemini 3.6 Flash 模型,面向快速且高成本效率的实际任务。它支持文本、图像、视频、音频和 PDF 输入,并输出文本。
Gemini 3.6 Flash 最适合哪些任务?+
它适合代码生成、快速代理循环、多模态与空间推理,以及长文档或混合媒体分析。
它的主要优势是什么?+
它支持思考、函数调用、结构化输出、搜索依据、代码执行和预览版计算机使用。Google 文档列出的输入上限为 1,048,576 个令牌,输出上限为 65,536 个令牌。
需要考虑哪些限制或取舍?+
该模型输出文本,不生成图像或音频;Google 也注明它不支持 Live API。计算机使用功能仍处于预览阶段,重要输出在投入生产前应进行审核。
如何通过 TokenHub 使用 gemini-3.6-flash?+
在 TokenHub API 请求中选择准确的模型 ID gemini-3.6-flash,并使用你的 TokenHub 接口地址和凭据。上线前请测试支持的参数、工具和流式行为。
它的定价和可用性如何?+
Google 将 gemini-3.6-flash 列为正式可用,价格为每百万输入令牌 1.50 美元、每百万输出令牌 7.50 美元。TokenHub 的定价、路由和地区可用性可能不同,请查看当前控制台。
应如何在 Gemini 3.6 Flash 与其他模型之间选择?+
当代理、编程或多模态工作负载需要兼顾速度与智能时,可选择它。最低成本的大批量任务可考虑 Flash-Lite;若推理深度比延迟和成本更重要,可考虑 Pro 级模型。
Gemini 3.6 Flash 媒体与演示
精选且已验证的 Gemini 3.6 Flash 公开帖子、视频与讨论。
X (Twitter)
Reddit
YouTube