Gemini 3.6 Flash

gemini-3.6-flash

Gemini 3.6 Flash est un modèle haute efficacité de Google pour le codage, les flux de travail agentiques et le développement web et d'applications. Il est conçu pour produire des résultats soignés avec moins de modifications inutiles et moins d'hésitations, tout en réduisant l'utilisation de tokens et le nombre d'appels au modèle nécessaires pour accomplir une tâche.

Contexte total

1Mtokens

Sortie max.

65.5Ktokens

Date de sortie

21 juil. 2026

Modalités

Prix de Gemini 3.6 Flash

Prix entréePrix sortieLecture cache
$1.5/M$7.5/M$0.15/M

Comment utiliser Gemini 3.6 Flash via l’API ?

POSTopenai/v1/chat/completions
POSTanthropic/v1/messages

Benchmark de Gemini 3.6 Flash

Gemini 3.6 Flash (high)

50.1

/100

Artificial Analysis Intelligence Index

Artificial Analysis broad capability aggregate

Score d’indice

69.2

/100

Artificial Analysis Coding Index

Artificial Analysis software task aggregate

Score d’indice

Knowledge & Reasoning

GPQA

Advanced science problem solving

92.8%

HLE

Broad expert-level exam set

38.3%

Coding & Engineering

SciCode

Scientific coding challenges

52.7%

Instruction Following & Agent Tasks

AA-LCR

Long-context reasoning

69.7%

Mesures provenant de Artificial Analysis

MéDias Et DéMonstrations De Gemini 3.6 Flash

Sélection vérifiée de publications, vidéos et discussions publiques sur Gemini 3.6 Flash.

X (Twitter)

Open social media source
View post on X
Open social media source
View post on X
Open social media source
View post on X

Reddit

YouTube

Open social media source
Watch on YouTube
Open social media source
Watch on YouTube
Open social media source
Watch on YouTube

FAQ Gemini 3.6 Flash

Questions et réponses utiles sur Gemini 3.6 Flash dans TokenHub.

Qu’est-ce que gemini-3.6-flash ?+

gemini-3.6-flash est la version stable de Gemini 3.6 Flash de Google, optimisée pour des tâches réelles rapides et économiques. Elle accepte texte, images, vidéo, audio et PDF, et produit du texte.

À quels usages Gemini 3.6 Flash convient-il le mieux ?+

Il convient à la génération de code, aux boucles agentiques rapides, au raisonnement multimodal et spatial, ainsi qu’à l’analyse de longs documents ou de médias mixtes.

Quels sont ses principaux atouts ?+

Il prend en charge le raisonnement, l’appel de fonctions, les sorties structurées, l’ancrage par recherche, l’exécution de code et l’usage de l’ordinateur en aperçu. Google indique 1 048 576 jetons en entrée et 65 536 en sortie.

Quelles limites ou quels compromis faut-il considérer ?+

Le modèle produit du texte et ne génère ni images ni audio ; Google indique aussi l’absence de prise en charge de la Live API. L’usage de l’ordinateur reste en aperçu et les sorties importantes doivent être vérifiées avant la production.

Comment utiliser gemini-3.6-flash via TokenHub ?+

Sélectionnez l’identifiant exact gemini-3.6-flash dans votre requête API TokenHub, puis utilisez le point d’accès et les identifiants TokenHub. Testez les paramètres, outils et comportements de streaming pris en charge avant la production.

Quels sont son tarif et sa disponibilité ?+

Google indique que gemini-3.6-flash est disponible généralement à 1,50 $ par million de jetons en entrée et 7,50 $ par million en sortie. Les tarifs, le routage et la disponibilité régionale de TokenHub peuvent différer ; consultez le tableau de bord actuel.

Comment choisir entre Gemini 3.6 Flash et d’autres modèles ?+

Choisissez-le pour équilibrer vitesse et intelligence dans les charges agentiques, de programmation ou multimodales. Préférez un modèle Flash-Lite pour les volumes élevés au coût minimal, ou un modèle de niveau Pro lorsque la profondeur de raisonnement prime sur la latence et le coût.