Gemini 3.6 Flash

gemini-3.6-flash

Gemini 3.6 Flash 是来自 Google 的高效模型,适用于编码、智能代理工作流以及网络和应用开发。它旨在生成精炼的输出,减少不必要的编辑和模棱两可的表述,同时降低完成任务所需的 Token 使用量和模型调用次数。

最大上下文

1MToken

最大输出

65.5KToken

发布日期

2026年7月21日

模态

Gemini 3.6 Flash 价格

输入价格输出价格缓存读取
$1.5/M$7.5/M$0.15/M

如何通过 API 使用 Gemini 3.6 Flash?

POSTopenai/v1/chat/completions
POSTanthropic/v1/messages

Gemini 3.6 Flash 基准测试

Gemini 3.6 Flash (high)

50.1

/100

Artificial Analysis 综合能力指数

Artificial Analysis 综合能力评分

指数分数

69.2

/100

Artificial Analysis 代码能力指数

Artificial Analysis 软件任务评分

指数分数

知识与推理

GPQA

高阶科学问题求解

92.8%

HLE

广泛专家级考试集合

38.3%

代码与工程

SciCode

科学计算代码挑战

52.7%

指令遵循与 Agent 任务

AA-LCR

长上下文推理

69.7%

指标来源 Artificial Analysis

Gemini 3.6 Flash 媒体与演示

精选且已验证的 Gemini 3.6 Flash 公开帖子、视频与讨论。

X (Twitter)

Open social media source
View post on X
Open social media source
View post on X
Open social media source
View post on X

Reddit

YouTube

Open social media source
Watch on YouTube
Open social media source
Watch on YouTube
Open social media source
Watch on YouTube

Gemini 3.6 Flash 常见问题

关于在 TokenHub 使用 Gemini 3.6 Flash 的实用问答。

gemini-3.6-flash 是什么?+

gemini-3.6-flash 是 Google 的稳定版 Gemini 3.6 Flash 模型,面向快速且高成本效率的实际任务。它支持文本、图像、视频、音频和 PDF 输入,并输出文本。

Gemini 3.6 Flash 最适合哪些任务?+

它适合代码生成、快速代理循环、多模态与空间推理,以及长文档或混合媒体分析。

它的主要优势是什么?+

它支持思考、函数调用、结构化输出、搜索依据、代码执行和预览版计算机使用。Google 文档列出的输入上限为 1,048,576 个令牌,输出上限为 65,536 个令牌。

需要考虑哪些限制或取舍?+

该模型输出文本,不生成图像或音频;Google 也注明它不支持 Live API。计算机使用功能仍处于预览阶段,重要输出在投入生产前应进行审核。

如何通过 TokenHub 使用 gemini-3.6-flash?+

在 TokenHub API 请求中选择准确的模型 ID gemini-3.6-flash,并使用你的 TokenHub 接口地址和凭据。上线前请测试支持的参数、工具和流式行为。

它的定价和可用性如何?+

Google 将 gemini-3.6-flash 列为正式可用,价格为每百万输入令牌 1.50 美元、每百万输出令牌 7.50 美元。TokenHub 的定价、路由和地区可用性可能不同,请查看当前控制台。

应如何在 Gemini 3.6 Flash 与其他模型之间选择?+

当代理、编程或多模态工作负载需要兼顾速度与智能时,可选择它。最低成本的大批量任务可考虑 Flash-Lite;若推理深度比延迟和成本更重要,可考虑 Pro 级模型。