Gemma 4 31B

gemma-4-31b-it

Gemma 4 26B A4B 是 Google DeepMind 推出的一款高效混合专家(MoE)模型,兼具 26B 级模型容量与推理时约 4B 的激活参数。它在推理、编程、多模态理解和智能体能力方面表现出色,同时相比更大的稠密模型可实现更快、更高效的推理。该模型支持文本与图像输入、256K 上下文窗口、原生函数调用以及 140 多种语言,非常适合 AI 智能体、编程应用、长上下文处理和高吞吐量工作负载。

上下文窗口

262.1K Token

最大输出

32.8K Token

发布日期

2026年4月2日

模态

Gemma 4 31B 价格

输入价格输出价格缓存读取
$0.75/M$1/M$0.75/M

Gemma 4 31B API 能力

推理

支持

工具调用

支持

Temperature 参数

支持

附件

支持

知识库

Endpoint 协议

Completions APIResponses APIMessages API

如何通过 TokenHub API 使用 Gemma 4 31B

创建 API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

准备调用 Gemma 4 31B?

通过一个 API Key 接入 Gemma 4 31B 与更多 AI 模型。

创建 API Key