Gemini 3.6 Flash
Contexte total
1M
Sortie max.
65.5K
Date de sortie
N/A
gemini-3.5-flashGemini 3.5 Flash reprend les éléments mis en avant par les sources : rapide/cost-efficient frontier Gemini model, raisonnement multimodal and long contextee agent focus. Sa valeur principale se situe dans agents réels, programmation, multi-étapes flux de travail and high-speed production use. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Context Window
1M tokens
Maximum Output
65.5K tokens
Release Date
19 mai 2026
Modalities
| Prix entrée | Prix sortie | Lecture cache | Création cache 5m |
|---|---|---|---|
| $1.5/M | $9/M | $0.15/M | $0.0833/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Gemini 3.5 Flash associe exécution agentique rapide, programmation performante et compréhension multimodale native pour les flux prolongés à grande échelle.
Il planifie, agit et itère rapidement dans les flux en plusieurs étapes, ce qui convient aux boucles de retour répétées des agents.
Il gère des cycles de développement complexes comprenant planification, implémentation, tests et corrections itératives dans une base de code.
Il traite texte, images, vidéo, audio et PDF dans une fenêtre de contexte dépassant un million de tokens en entrée.
Gemini 3.5 Flash convient aux systèmes collaboratifs de sous-agents, à la modernisation de codebases et à l’analyse de longs documents multimodaux.
Déployer des agents spécialisés en parallèle pour rechercher, construire et réviser différentes parties d’un objectif plus vaste.
Analyser un dépôt existant, planifier les changements de framework ou d’architecture et migrer le code par itérations avec vérification.
Examiner de longs PDF contenant texte, graphiques, images ou médias intégrés, extraire les preuves essentielles et produire des résultats structurés.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| Score d’indice | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Synthèse générale des capacités par Artificial Analysis | 34.9 |
| Artificial Analysis Coding Index | Synthèse des tâches logicielles par Artificial Analysis | 47.1 |
| Connaissances et raisonnement | ||
| GPQA | Résolution avancée de problèmes scientifiques | 82.8% |
| HLE | Large ensemble d’examens de niveau expert | 23.1% |
| Programmation et ingénierie | ||
| SciCode | Défis de programmation scientifique | 48.8% |
| Terminal-Bench Hard | Exécution de tâches complexes dans un terminal | 46.2% |
| Respect des instructions et tâches d’agent | ||
| IFBench | Respect des contraintes du prompt | 47.3% |
| AA-LCR | Raisonnement en contexte long | 53.3% |
| τ²-Bench | Tâches de workflow agentique | 58.8% |
Mesures provenant de Artificial Analysis
Découvrez le positionnement de Gemini 3.5 Flash, ses meilleurs usages, ses points forts, ses limites pratiques et les précautions d’intégration avec TokenHub.
Gemini 3.5 Flash est le modèle Flash actuel de Google pour des charges agentiques et multimodales rapides et évolutives. Il s’agit d’un modèle public actuel du fournisseur, avec une disponibilité qui peut varier selon la plateforme.
Usages recommandés : les boucles d’agents à grand volume et l’orchestration de sous-agents, les tâches d’ingénierie logicielle difficiles et l’analyse d’entrées textuelles et visuelles. Avant la production, testez des entrées représentatives et définissez des critères d’acceptation mesurables.
Principaux atouts : un bon équilibre entre qualité, vitesse et coût, des temps de réponse rapides et une exécution fiable des workflows agentiques en plusieurs étapes. Cet ensemble est particulièrement utile pour les tâches d’ingénierie logicielle difficiles.
Envisagez un autre modèle si la tâche exige le raisonnement le plus puissant de la gamme Pro, l’application exige que ce modèle textuel renvoie directement des images générées ou le processus ne permet aucune validation humaine des décisions importantes. Faites valider par une personne qualifiée les résultats importants de nature factuelle, juridique, financière, médicale ou opérationnelle.
Dans TokenHub, sélectionnez l’identifiant exact affiché pour Gemini 3.5 Flash, utilisez l’endpoint documenté pour votre compte et vos identifiants TokenHub. Vérifiez les types d’entrée, outils, options d’ancrage et le cycle de vie réellement exposés par TokenHub, sans supposer une parité complète avec l’API Gemini.
Accédez à Gemini 3.5 Flash et à d’autres modèles d’IA avec une seule clé API TokenHub.
MéDias Et Discussions
Sélection de vidéos et publications publiques liées à ce modèle.
X (Twitter)
Reddit
YouTube