Modèles

Explorez les tarifs, capacités, points de terminaison et fournisseurs des modèles d'IA depuis un catalogue de production unique.

OpenAI

GPT-6.1 Sol

gpt-6.1-sol

GPT-6.1 Sol est un modèle de raisonnement avancé conçu pour la résolution de problèmes complexes, le codage et les applications basées sur des agents. Il est conçu pour offrir de solides performances de raisonnement tout en maintenant un équilibre pratique entre intelligence, vitesse et coût. Contrairement aux modèles de chat traditionnels qui se concentrent principalement sur la génération de réponses, GPT-6.1 Sol est optimisé pour les tâches nécessitant une réflexion plus approfondie, notamment le raisonnement multi-étapes, la génération de code, le débogage, l'analyse de données et le suivi d'instructions complexes. GPT-6.1 Sol prend en charge des workflows de raisonnement fiables, des sorties structurées et des applications basées sur des outils, ce qui le rend adapté aux développeurs créant des assistants IA, des agents de codage, des systèmes d'automatisation et des applications IA de production.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

29 sept. 2026

Entrée$2 / M tokens
Sortie$10 / M tokens
Lecture cache$0.1 / M tokens

OpenAI

GPT-6.1 Sol Pro

gpt-6.1-sol-pro

GPT-6.1 Sol Pro est une version de raisonnement améliorée de GPT-6.1 Sol. Il utilise le même modèle sous-jacent que GPT-6.1 Sol, mais active reasoning.mode=pro, ce qui permet au modèle de consacrer beaucoup plus de calcul à chaque requête. Le budget de raisonnement supplémentaire aide GPT-6.1 Sol Pro à traiter des problèmes plus difficiles nécessitant une analyse plus poussée, une planification plus longue et une meilleure précision. Il est conçu pour les tâches où obtenir la meilleure réponse possible est plus important que la vitesse de réponse ou la rentabilité. Par rapport à GPT-6.1 Sol, GPT-6.1 Sol Pro consomme beaucoup plus de jetons de raisonnement par requête, ce qui entraîne des coûts d’utilisation plus élevés et des temps de réponse plus longs.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

29 sept. 2026

Entrée$2 / M tokens
Sortie$10 / M tokens
Lecture cache$0.1 / M tokens

Anthropic

Claude Sonnet 5.5

claude-sonnet-5.5

Claude Sonnet 5.5 est un modèle d'IA de nouvelle génération conçu pour le raisonnement avancé, le codage, l'analyse et les workflows agentiques complexes. Il offre d'excellentes performances en développement logiciel, en compréhension de contextes longs, en tâches multimodales et en travail intellectuel professionnel, avec un équilibre optimal entre intelligence, rapidité et efficacité. Grâce à des capacités de raisonnement renforcées et à un meilleur suivi des instructions, Claude Sonnet 5.5 excelle dans l'écriture et le débogage de code, l'analyse de documents complexes, la résolution de problèmes à plusieurs étapes et l'alimentation d'agents IA nécessitant des décisions fiables et l'usage d'outils.

Contexte total

1M

Sortie max.

128K

Date de sortie

28 sept. 2026

Entrée$2 / M tokens
Sortie$10 / M tokens
Lecture cache$0.2 / M tokens

xAI

Grok 4.7

grok-4.7

Grok 4.7 est le modèle de dernière génération de xAI, conçu pour les tâches de codage exigeantes, le raisonnement complexe et les applications à forte intensité de connaissances. Il améliore la résolution de problèmes sur le long terme, l'auto-vérification et l'exécution des workflows, ce qui le rend adapté aux développeurs qui créent des assistants intelligents et des produits propulsés par l'IA. Grok 4.7 offre d'excellentes performances en programmation, en analyse et sur les tâches d'IA généralistes, tout en conservant une efficacité compétitive pour les déploiements en production.

Contexte total

500K

Sortie max.

500K

Date de sortie

21 sept. 2026

Entrée$1.6 / M tokens
Sortie$4.8 / M tokens
Lecture cache$0.4 / M tokens

Anthropic

Claude Opus 5.5

claude-opus-5.5

Claude Opus 5.5 est le modèle d'intelligence phare d'Anthropic, conçu pour les charges de travail exigeantes nécessitant un raisonnement approfondi, une grande fiabilité et l'exécution de tâches de longue durée. Il offre d'excellentes performances en ingénierie logicielle, dans les workflows agentiques, l'analyse professionnelle et les tâches à forte intensité de connaissances. Grâce à une efficacité améliorée et à des garde-fous renforcés, Claude Opus 5.5 est optimisé pour les développeurs qui créent des applications d'IA sophistiquées exigeant des performances constantes sur des tâches complexes.

Contexte total

1M

Sortie max.

128K

Date de sortie

22 sept. 2026

Entrée$4 / M tokens
Sortie$20 / M tokens
Lecture cache$0.2 / M tokens

OpenAI

GPT-6 Sol

gpt-6-sol

GPT-6 Sol est un modèle hautes performances de la série GPT-6 d'OpenAI, conçu pour les tâches de raisonnement complexes, le développement logiciel et les workflows IA professionnels. Il offre une intelligence renforcée pour la résolution de problèmes en plusieurs étapes, le codage avancé, l'analyse de données et les applications à base d'agents. GPT-6 Sol associe de solides capacités de raisonnement à une inférence efficace, ce qui le destine aux développeurs ayant besoin de performances de pointe pour des systèmes d'IA en production.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

22 sept. 2026

Entrée$2 / M tokens
Sortie$10 / M tokens
Lecture cache$0.2 / M tokens

OpenAI

GPT-6 Sol Pro

gpt-6-sol-pro

GPT-6 Sol Pro est une variante de raisonnement améliorée de GPT-6 Sol, conçue pour les tâches nécessitant une analyse plus approfondie, une précision accrue et une exécution multi-étapes plus fiable. Grâce à des capacités de raisonnement renforcées, GPT-6 Sol Pro offre de meilleures performances en ingénierie logicielle, dans les workflows complexes, l'analyse de données et les applications d'agents IA. Il est optimisé pour les développeurs qui créent des systèmes d'IA avancés nécessitant des résultats constants sur des tâches difficiles. GPT-6 Sol Pro prend en charge le traitement de contextes longs, l'appel d'outils et les sorties structurées, ce qui le rend adapté aux applications de production exigeant de puissantes capacités de raisonnement et d'automatisation.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

22 sept. 2026

Entrée$2 / M tokens
Sortie$10 / M tokens
Lecture cache$0.2 / M tokens

OpenAI

GPT-6 Luna

gpt-6-luna

GPT-6 Luna est un modèle compact et efficace de la famille GPT-6 d’OpenAI, conçu pour offrir une intelligence linguistique solide avec une efficacité de coût nettement améliorée. Il fournit des performances fiables pour les applications d’IA quotidiennes, notamment l’IA conversationnelle, la génération de contenu, l’assistance au codage et les workflows d’automatisation. Grâce à une grande fenêtre de contexte et à une efficacité d’inférence optimisée, GPT-6 Luna est idéal pour les développeurs qui créent des produits d’IA évolutifs nécessitant un débit élevé, une faible latence et des coûts d’exploitation prévisibles.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

22 sept. 2026

Entrée$0.1 / M tokens
Sortie$0.5 / M tokens
Lecture cache$0.01 / M tokens

OpenAI

GPT-6 Luna Pro

gpt-6-luna-pro

GPT-6 Luna Pro est une version optimisée pour le raisonnement de GPT-6 Luna, conçue pour offrir une meilleure capacité de résolution de problèmes tout en conservant l’efficacité et l’accessibilité de la famille Luna. Il améliore les performances sur les instructions complexes, les tâches de codage, les workflows d’analyse et les applications d’agents légers par rapport aux modèles d’inférence rapide standard. GPT-6 Luna Pro est idéal pour les développeurs qui ont besoin de réponses de meilleure qualité tout en maintenant l’évolutivité pour les charges de travail de production. Avec la prise en charge du traitement de contextes longs, de l’appel de fonctions et des sorties structurées, GPT-6 Luna Pro offre une solution équilibrée entre intelligence, vitesse et rentabilité.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

22 sept. 2026

Entrée$0.1 / M tokens
Sortie$0.5 / M tokens
Lecture cache$0.01 / M tokens

Alibaba

Qwen3.8 Omni Flash

qwen3.8-omni-flash

Qwen3.8 Omni Flash est un modèle omni-modal de nouvelle génération de la famille Qwen d’Alibaba, conçu pour comprendre et traiter le texte, les images, l’audio et la vidéo au sein d’un système d’IA unifié. Il combine une solide intelligence linguistique et des capacités avancées de compréhension multimodale pour des applications d’IA réelles. Avec une fenêtre de contexte allant jusqu’à 1 M de tokens, Qwen3.8 Omni Flash est optimisé pour l’analyse de documents longs, la compréhension multimédia et les workflows agentiques. Il peut analyser des contenus audio et vidéo complexes, raisonner sur plusieurs modalités et prendre en charge l’appel d’outils pour créer des applications d’IA intelligentes. Conçu pour un déploiement très efficace, Qwen3.8 Omni Flash offre un excellent équilibre entre intelligence multimodale, évolutivité et rentabilité, ce qui le rend adapté aux développeurs qui créent des assistants IA de nouvelle génération, des systèmes d’analyse de contenu et des agents d’automatisation.

Contexte total

1M

Sortie max.

131.1K

Date de sortie

17 sept. 2026

Entrée$0.1143 / M tokens
Sortie$0.3857 / M tokens
Lecture cache$0.0143 / M tokens

TypeSafe

Jev 1.13

jev-1.13

Jev 1.13 est le premier modèle de décision System One de TypeSafe AI, conçu pour le jugement IA structuré plutôt que pour la génération de texte. Il analyse le contexte fourni et renvoie des choix structurés, des scores et des décisions fondées sur la confiance. Conçu pour les workflows de classification, de routage, d'évaluation et d'automatisation, Jev fournit des décisions IA rapides et prévisibles avec une faible latence et une utilisation efficace des tokens.

Contexte total

32K

Sortie max.

N/A

Date de sortie

18 sept. 2026

Entrée$0.042 / M tokens
Sortie$0 / M tokens

Z.ai

GLM-5.3-FlashX

glm-5.3-flashx

GLM-5.3-FlashX est un modèle multimodal à grande vitesse de Z.ai, conçu pour une inférence rapide et réactive tout en conservant les capacités essentielles de GLM-5.3-Flash. Il prend en charge les entrées texte, image, vidéo et fichier, avec une fenêtre de contexte allant jusqu'à 1 million de tokens. Le modèle performe bien en codage, workflows agentiques, compréhension visuelle, tâches à long contexte et raisonnement complexe, ce qui en fait un excellent choix pour les applications d'IA en temps réel exigeant à la fois vitesse et intelligence.

Contexte total

1M

Sortie max.

131.1K

Date de sortie

18 sept. 2026

Entrée$0.2857 / M tokens
Sortie$1 / M tokens
Lecture cache$0.0814 / M tokens

DeepSeek

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek-V4.1-Flash est un modèle d’IA multimodal rapide et efficace, doté de capacités avancées de raisonnement, de codage et d’agent. Prenant en charge jusqu’à 1 million de tokens de contexte et une compréhension visuelle native, il offre une intelligence de pointe à moindre coût d’inférence, ce qui le rend idéal pour les agents IA, l’automatisation, les assistants de codage et les applications évolutives.

Contexte total

1M

Sortie max.

384K

Date de sortie

10 sept. 2026

Entrée$0.2857 / M tokens
Sortie$1.1429 / M tokens
Lecture cache$0.0057 / M tokens

OpenAI

GPT-6 Astra

gpt-6-astra

GPT-6 Astra est le nouveau modèle phare d'OpenAI, conçu pour le raisonnement complexe, le génie logiciel, les agents IA, la recherche et les flux de travail professionnels exigeants de bout en bout. Il excelle dans les tâches multi-étapes couvrant le code, les navigateurs et les logiciels professionnels, offrant de meilleures performances en résolution de problèmes, utilisation d'outils, utilisation d'un ordinateur et compréhension de contextes longs. GPT-6 Astra prend en charge une fenêtre de contexte allant jusqu'à 1,05 M de jetons et une sortie maximale de 128 K jetons, avec plusieurs niveaux d'effort de raisonnement — Low, Medium, High, XHigh et Max — permettant aux développeurs d'équilibrer capacité de raisonnement, efficacité et coût selon la complexité de la tâche. Il convient parfaitement aux agents IA avancés, au développement logiciel complexe, aux flux de travail automatisés, à la recherche approfondie, au traitement de longs documents, à l'analyse de données et aux applications d'IA d'entreprise.

Contexte total

1.1M

Sortie max.

128K

Date de sortie

4 sept. 2026

Entrée$10 / M tokens
Sortie$50 / M tokens
Lecture cache$1 / M tokens

Anthropic

Claude Fable 5.1

claude-fable-5.1

Claude Fable 5 est le modèle de classe Mythos d’Anthropic, conçu pour le raisonnement exigeant, le génie logiciel, le travail de la connaissance, l’analyse visuelle et la recherche scientifique. Pensé pour les tâches agentiques à long terme, il peut maintenir planification et exécution sur des flux de travail complexes, analyser de grandes bases de code et des documents, et affiner son travail sur plusieurs étapes. Claude Fable 5 convient parfaitement aux applications de production qui exigent un codage avancé, de la recherche, une analyse professionnelle et une exécution autonome fiable.

Contexte total

1M

Sortie max.

128K

Date de sortie

1 sept. 2026

Entrée$10 / M tokens
Sortie$50 / M tokens
Lecture cache$0.25 / M tokens

Z.ai

GLM-5.3-Flash

glm-5.3-flash

GLM-5.3-Flash est le premier modèle nativement multimodal de Z.ai dans la famille GLM-5, conçu pour le codage rapide, la compréhension visuelle et les workflows d'agents. Son architecture MoE de 320B paramètres active 18B paramètres par jeton et combine attention sparse et attention linéaire pour rendre les tâches à long contexte plus efficaces. Utilisez l'API GLM via TokenHub pour évaluer le prix actuel de GLM-5.3-Flash, l'ID du modèle, les entrées prises en charge, l'appel d'outils, les limites de contexte et les points de terminaison avant de le déployer pour du codage en production ou des tâches d'agents multimodaux.

Contexte total

1M

Sortie max.

131.1K

Date de sortie

26 août 2026

Entrée$0.1143 / M tokens
Sortie$0.4 / M tokens
Lecture cache$0.0329 / M tokens

Z.ai

GLM-5.3

glm-5.3

GLM-5.3 est le dernier modèle phare de Z.ai, conçu pour le codage avancé, l'ingénierie logicielle et les tâches d'agent à long terme. Avec une fenêtre de contexte de 1M de jetons, jusqu'à 128K jetons de sortie, de solides capacités de raisonnement et d'utilisation d'outils, il est idéal pour les agents de codage, les flux de développement complexes et l'automatisation en plusieurs étapes.

Contexte total

1M

Sortie max.

128K

Date de sortie

19 août 2026

Entrée$1.1429 / M tokens
Sortie$4 / M tokens
Lecture cache$0.2857 / M tokens

Tencent

Hy4 preview

hy4-preview

Hy4 preview est le modèle phare open source de nouvelle génération de Tencent Hunyuan, basé sur une architecture Mixture-of-Experts. Conçu pour les tâches de productivité concrètes : codage, travail bureautique, recherche scientifique, raisonnement sur de longs contextes et workflows d’agents complexes. Également connu sous les noms Tencent Hy4 preview ou Hunyuan 4 preview, il compte 770B de paramètres au total, active 49B de paramètres par jeton et prend en charge une fenêtre contextuelle de plus de 1M de jetons. Le modèle excelle dans la compréhension de grandes bases de code et de documents, la planification en plusieurs étapes, l’utilisation d’outils, le débogage, la validation et l’exécution prolongée de tâches.

Contexte total

1M

Sortie max.

64K

Date de sortie

28 août 2026

Entrée$0.8571 / M tokens
Sortie$2.5714 / M tokens
Lecture cache$0.0429 / M tokens

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max est un modèle phare MoE de 2,4 billions de paramètres conçu pour le raisonnement avancé, le codage et la productivité des entreprises. Il peut exécuter de manière autonome des tâches complexes et de longue durée — du développement logiciel aux flux de travail professionnels — en fournissant des résultats de qualité production dans des domaines tels que le droit, la finance et le design. Propulsé par une intelligence multimodale native, Qwen3.8-Max comprend le texte, les images et les vidéos sur de longs contextes, prenant en charge l'analyse approfondie de documents volumineux et de contenus de forme longue. Ses capacités d'agent permettent une planification, une exécution, une vérification et une itération continues autonomes tout au long de flux de travail complexes.

Contexte total

1M

Sortie max.

128K

Date de sortie

3 août 2026

Entrée$2 / M tokens
Sortie$6 / M tokens
Lecture cache$0.25 / M tokens

Moonshot

Kimi K3

kimi-k3

Kimi K3 est un modèle d'IA haute performance conçu pour le raisonnement avancé, le codage et l'exécution de tâches complexes. Il offre des performances solides sur les projets de programmation à grande échelle, la résolution de problèmes en plusieurs étapes et les applications à forte intensité de connaissances. Avec une gestion étendue du contexte et des capacités multimodales, K3 est adapté à la création d'agents IA puissants, d'outils développeurs et d'applications d'entreprise.

Contexte total

1M

Sortie max.

131.1K

Date de sortie

16 juil. 2026

Entrée$2.8571 / M tokens
Sortie$14.2857 / M tokens
Lecture cache$0.2857 / M tokens

DeepSeek

DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp est une variante expérimentale de DeepSeek V4 Flash 0731 dotée de capacités visuelles, introduisant la compréhension d'images tout en préservant les performances textuelles du modèle de base, notamment les capacités d'agent, le raisonnement et la connaissance du monde. Il repose sur une architecture de mélange d'experts (MoE) sparse avec 284B paramètres au total et 13B paramètres actifs.

Contexte total

1M

Sortie max.

384K

Date de sortie

21 août 2026

Entrée$0.2857 / M tokens
Sortie$1.1429 / M tokens
Lecture cache$0.0057 / M tokens

Modèles populaires recommandés

Commencez par les modèles les plus visibles du catalogue en direct, puis ouvrez une page détail pour comparer contexte, endpoints et prix effectif.

OpenAI

GPT-6.1 Sol

GPT-6.1 Sol est un modèle de raisonnement avancé conçu pour la résolution de problèmes complexes, le codage et les applications basées sur des agents. Il est conçu pour offrir de solides performances de raisonnement tout en maintenant un équilibre pratique entre intelligence, vitesse et coût. Contrairement aux modèles de chat traditionnels qui se concentrent principalement sur la génération de réponses, GPT-6.1 Sol est optimisé pour les tâches nécessitant une réflexion plus approfondie, notamment le raisonnement multi-étapes, la génération de code, le débogage, l'analyse de données et le suivi d'instructions complexes. GPT-6.1 Sol prend en charge des workflows de raisonnement fiables, des sorties structurées et des applications basées sur des outils, ce qui le rend adapté aux développeurs créant des assistants IA, des agents de codage, des systèmes d'automatisation et des applications IA de production.

Contexte total

1.1M

Prix entrée

$2 / M tokens

Voir le modèle

OpenAI

GPT-6.1 Sol Pro

GPT-6.1 Sol Pro est une version de raisonnement améliorée de GPT-6.1 Sol. Il utilise le même modèle sous-jacent que GPT-6.1 Sol, mais active reasoning.mode=pro, ce qui permet au modèle de consacrer beaucoup plus de calcul à chaque requête. Le budget de raisonnement supplémentaire aide GPT-6.1 Sol Pro à traiter des problèmes plus difficiles nécessitant une analyse plus poussée, une planification plus longue et une meilleure précision. Il est conçu pour les tâches où obtenir la meilleure réponse possible est plus important que la vitesse de réponse ou la rentabilité. Par rapport à GPT-6.1 Sol, GPT-6.1 Sol Pro consomme beaucoup plus de jetons de raisonnement par requête, ce qui entraîne des coûts d’utilisation plus élevés et des temps de réponse plus longs.

Contexte total

1.1M

Prix entrée

$2 / M tokens

Voir le modèle

Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 est un modèle d'IA de nouvelle génération conçu pour le raisonnement avancé, le codage, l'analyse et les workflows agentiques complexes. Il offre d'excellentes performances en développement logiciel, en compréhension de contextes longs, en tâches multimodales et en travail intellectuel professionnel, avec un équilibre optimal entre intelligence, rapidité et efficacité. Grâce à des capacités de raisonnement renforcées et à un meilleur suivi des instructions, Claude Sonnet 5.5 excelle dans l'écriture et le débogage de code, l'analyse de documents complexes, la résolution de problèmes à plusieurs étapes et l'alimentation d'agents IA nécessitant des décisions fiables et l'usage d'outils.

Contexte total

1M

Prix entrée

$2 / M tokens

Voir le modèle

xAI

Grok 4.7

Grok 4.7 est le modèle de dernière génération de xAI, conçu pour les tâches de codage exigeantes, le raisonnement complexe et les applications à forte intensité de connaissances. Il améliore la résolution de problèmes sur le long terme, l'auto-vérification et l'exécution des workflows, ce qui le rend adapté aux développeurs qui créent des assistants intelligents et des produits propulsés par l'IA. Grok 4.7 offre d'excellentes performances en programmation, en analyse et sur les tâches d'IA généralistes, tout en conservant une efficacité compétitive pour les déploiements en production.

Contexte total

500K

Prix entrée

$1.6 / M tokens

Voir le modèle

Anthropic

Claude Opus 5.5

Claude Opus 5.5 est le modèle d'intelligence phare d'Anthropic, conçu pour les charges de travail exigeantes nécessitant un raisonnement approfondi, une grande fiabilité et l'exécution de tâches de longue durée. Il offre d'excellentes performances en ingénierie logicielle, dans les workflows agentiques, l'analyse professionnelle et les tâches à forte intensité de connaissances. Grâce à une efficacité améliorée et à des garde-fous renforcés, Claude Opus 5.5 est optimisé pour les développeurs qui créent des applications d'IA sophistiquées exigeant des performances constantes sur des tâches complexes.

Contexte total

1M

Prix entrée

$4 / M tokens

Voir le modèle

OpenAI

GPT-6 Sol

GPT-6 Sol est un modèle hautes performances de la série GPT-6 d'OpenAI, conçu pour les tâches de raisonnement complexes, le développement logiciel et les workflows IA professionnels. Il offre une intelligence renforcée pour la résolution de problèmes en plusieurs étapes, le codage avancé, l'analyse de données et les applications à base d'agents. GPT-6 Sol associe de solides capacités de raisonnement à une inférence efficace, ce qui le destine aux développeurs ayant besoin de performances de pointe pour des systèmes d'IA en production.

Contexte total

1.1M

Prix entrée

$2 / M tokens

Voir le modèle

Comparaison de modèles

Comparaison rapide avec les modèles voisins sélectionnés du catalogue.

FAQ du catalogue de modèles

Un guide rapide pour choisir, comparer et utiliser les modèles du catalogue TokenHub.

Comment choisir un modèle dans cette liste ?

+

Partez de votre cas d’usage. Utilisez les filtres par fournisseur, tags, type d’endpoint et groupe de facturation, puis comparez la taille de contexte, la sortie maximale, les modalités et les prix d’entrée ou de sortie.

Que signifie le prix effectif ?

+

Le prix effectif applique le ratio du groupe de facturation actif aux données tarifaires du modèle. Il aide à estimer le coût réel d’entrée, de sortie ou par requête pour le groupe utilisé.

Ces modèles sont-ils utilisables via des endpoints API ?

+

Oui. Ouvrez la page détail d’un modèle pour voir les types d’endpoints pris en charge et les liens de documentation. La disponibilité peut varier selon le modèle, le fournisseur et la configuration de routage.

Pourquoi la fenêtre de contexte et la sortie maximale comptent-elles ?

+

La fenêtre de contexte définit la quantité de prompt et d’historique que le modèle peut lire. La sortie maximale définit la quantité générée en une réponse, ce qui compte pour les textes longs, le code et les documents.