Gemini 3.6 Flash
gemini-3.6-flash
最大上下文
1M
最大输出
65.5K
发布日期
暂无
输入$1.5 / 百万 Token
输出$7.5 / 百万 Token
gemma-4-26b-a4b-itGemma 4 31B 是 Google DeepMind 在 Gemma 4 系列中能力最强的稠密模型,专为高级推理、编程、多模态理解和智能体工作流而设计。它拥有 307 亿参数,上下文窗口最高支持 256K tokens,可同时处理文本和图像,胜任复杂的长上下文任务。该模型还原生支持函数调用和 140 多种语言,是编程助手、智能代理、文档分析以及高要求通用 AI 应用的理想选择。
上下文窗口
262.1K Token
最大输出
32.8K Token
发布日期
2026年4月2日
模态
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $0.15/M | $0.6/M | $0.05/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.responses.create({})
console.log(result.output_text)通过一个 API Key 接入 Gemma 4 26B A4B 与更多 AI 模型。