Gemini 3.6 Flash
Contexte total
1M
Sortie max.
65.5K
Date de sortie
N/A
gemma-4-31b-itGemma 4 26B A4B est un modèle Mixture-of-Experts (MoE) efficace de Google DeepMind, qui associe une capacité de modèle de classe 26B à environ 4B de paramètres actifs lors de l'inférence. Il offre de solides capacités de raisonnement, de codage, de compréhension multimodale et d'agent, tout en proposant une inférence plus rapide et plus efficace que les grands modèles denses. Compatible avec les entrées texte et image, une fenêtre de contexte de 256K, l'appel de fonctions natif et plus de 140 langues, il convient parfaitement aux agents IA, aux applications de codage, au traitement de longs contextes et aux charges de travail à haut débit.
Context Window
262.1K tokens
Maximum Output
32.8K tokens
Release Date
2 avr. 2026
Modalities
| Prix entrée | Prix sortie | Lecture cache |
|---|---|---|
| $0.75/M | $1/M | $0.75/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)Accédez à Gemma 4 31B et à d’autres modèles d’IA avec une seule clé API TokenHub.