Gemma 4 31B

gemma-4-31b-it

Gemma 4 26B A4B est un modèle Mixture-of-Experts (MoE) efficace de Google DeepMind, qui associe une capacité de modèle de classe 26B à environ 4B de paramètres actifs lors de l'inférence. Il offre de solides capacités de raisonnement, de codage, de compréhension multimodale et d'agent, tout en proposant une inférence plus rapide et plus efficace que les grands modèles denses. Compatible avec les entrées texte et image, une fenêtre de contexte de 256K, l'appel de fonctions natif et plus de 140 langues, il convient parfaitement aux agents IA, aux applications de codage, au traitement de longs contextes et aux charges de travail à haut débit.

Context Window

262.1K tokens

Maximum Output

32.8K tokens

Release Date

2 avr. 2026

Modalities

Prix de Gemma 4 31B

Prix entréePrix sortieLecture cache
$0.75/M$1/M$0.75/M

Fonctionnalités API de Gemma 4 31B

Reasoning

Supported

Tool calling

Supported

Temperature parameter

Supported

Attachments

Supported

Knowledge Base

Endpoint Protocols

Completions APIResponses APIMessages API

Comment utiliser Gemma 4 31B via l’API TokenHub

Create API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

Prêt à utiliser Gemma 4 31B ?

Accédez à Gemma 4 31B et à d’autres modèles d’IA avec une seule clé API TokenHub.

Créer une clé API