Gemini 3.6 Flash
gemini-3.6-flash
最大上下文
1M
最大输出
65.5K
发布日期
暂无
输入$1.5 / 百万 Token
输出$7.5 / 百万 Token
gemma-4-31b-itGemma 4 26B A4B 是 Google DeepMind 推出的一款高效混合专家(MoE)模型,兼具 26B 级模型容量与推理时约 4B 的激活参数。它在推理、编程、多模态理解和智能体能力方面表现出色,同时相比更大的稠密模型可实现更快、更高效的推理。该模型支持文本与图像输入、256K 上下文窗口、原生函数调用以及 140 多种语言,非常适合 AI 智能体、编程应用、长上下文处理和高吞吐量工作负载。
上下文窗口
262.1K Token
最大输出
32.8K Token
发布日期
2026年4月2日
模态
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $0.75/M | $1/M | $0.75/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)通过一个 API Key 接入 Gemma 4 31B 与更多 AI 模型。