Qwen3.8-Max est un modèle phare MoE de 2,4 billions de paramètres conçu pour le raisonnement avancé, le codage et la productivité des entreprises. Il peut exécuter de manière autonome des tâches complexes et de longue durée — du développement logiciel aux flux de travail professionnels — en fournissant des résultats de qualité production dans des domaines tels que le droit, la finance et le design. Propulsé par une intelligence multimodale native, Qwen3.8-Max comprend le texte, les images et les vidéos sur de longs contextes, prenant en charge l'analyse approfondie de documents volumineux et de contenus de forme longue. Ses capacités d'agent permettent une planification, une exécution, une vérification et une itération continues autonomes tout au long de flux de travail complexes.
Date de sortie
3 août 2026
Entrée$2 / M tokens
Sortie$6 / M tokens
Lecture cache$0.25 / M tokens
Kimi K3 est un modèle d'IA haute performance conçu pour le raisonnement avancé, le codage et l'exécution de tâches complexes. Il offre des performances solides sur les projets de programmation à grande échelle, la résolution de problèmes en plusieurs étapes et les applications à forte intensité de connaissances. Avec une gestion étendue du contexte et des capacités multimodales, K3 est adapté à la création d'agents IA puissants, d'outils développeurs et d'applications d'entreprise.
Date de sortie
16 juil. 2026
Entrée$2.8571 / M tokens
Sortie$14.2857 / M tokens
Lecture cache$0.2857 / M tokens
GPT-5.6 Sol est la version standard de la série Sol. Elle convient aux questions-réponses générales, au traitement de texte, à la rédaction de contenus, au résumé, à l’assistance légère en programmation et aux tâches d’automatisation métier.
Sol est conçue pour les scénarios qui nécessitent de solides capacités générales tout en tenant compte de l’efficacité de réponse et des coûts. Elle peut être utilisée pour les fonctionnalités produit, les assistants conversationnels, les outils de génération de contenu, le nettoyage de données, les Q&A sur base de connaissances et les traitements par lots. Pour un usage à grande échelle ou un prototypage rapide, Sol offre un point de départ flexible.
Date de sortie
9 juil. 2026
Entrée$5 / M tokens
Sortie$30 / M tokens
Lecture cache$0.5 / M tokens
GPT-5.6 Sol Pro est la version Pro de la série Sol, conçue pour les tâches complexes et une sortie de haute qualité. Il convient à la rédaction avancée, aux questions-réponses précises, au raisonnement commercial, à la génération de code, à l'analyse structurée et à l'exécution de tâches multi-tours.
Sol Pro est adapté aux tâches qui exigent une plus grande précision, une compréhension contextuelle et l'achèvement des instructions. Il peut être utilisé pour la production de contenu professionnel, les assistants d'analyse de données, les systèmes de questions-réponses de connaissances, les flux de travail d'agents complexes et les outils d'IA d'entreprise internes.
Date de sortie
9 juil. 2026
Entrée$5 / M tokens
Sortie$30 / M tokens
Lecture cache$0.5 / M tokens
GPT-5.6 Terra est la version polyvalente de la série Terra. Elle convient aux conversations quotidiennes, à la génération de texte, au résumé, à l'extraction d'informations, au raisonnement léger et à l'assistance au codage.
Terra offre un équilibre pratique entre capacités générales, efficacité de réponse et coût. Elle peut être utilisée pour des assistants conversationnels, des outils de contenu, l'automatisation bureautique, des questions-réponses sur base de connaissances et des workflows de traitement de texte par lots. Pour des itérations rapides ou des applications sensibles aux coûts, Terra est un excellent choix par défaut au sein de la série Terra.
Date de sortie
9 juil. 2026
Entrée$2.5 / M tokens
Sortie$15 / M tokens
Lecture cache$0.275 / M tokens
GPT-5.6 Terra Pro est la version améliorée de la série Terra, conçue pour des résultats de haute qualité sur des tâches complexes. Idéal pour les questions-réponses avancées, la création de contenu approfondi, l'analyse commerciale, l'assistance au codage et le raisonnement en plusieurs étapes. Comparé à la version standard, Terra Pro convient mieux aux scénarios nécessitant une fiabilité accrue, un raisonnement plus complet et un meilleur suivi des instructions. Adapté à la rédaction professionnelle, la synthèse d'informations complexes, les assistants basés sur des connaissances, les agents d'automatisation et les applications d'IA de niveau entreprise.
Date de sortie
9 juil. 2026
Entrée$2.5 / M tokens
Sortie$15 / M tokens
Lecture cache$0.275 / M tokens
GPT-5.6 Luna est la version polyvalente de la gamme Luna, adaptée aux applications IA quotidiennes. Il peut être utilisé pour le chat Q&R, la réécriture de textes, le résumé, l'extraction d'informations, le raisonnement simple, l'assistance au codage et l'automatisation bureautique.
Luna est un choix pratique pour les prototypes, les fonctionnalités métier légères, le traitement de contenu par lots et les scénarios courants d'interaction utilisateur. C'est un bon modèle de départ lorsque la vitesse, la simplicité et le contrôle des coûts sont importants ; pour les tâches nécessitant une qualité supérieure ou des résultats plus stables, vous pouvez envisager Luna Pro.
Date de sortie
9 juil. 2026
Entrée$1 / M tokens
Sortie$6 / M tokens
Lecture cache$0.1 / M tokens
GPT-5.6 Luna Pro est la version améliorée de la série Luna, destinée à fournir des réponses de meilleure qualité, un suivi d'instructions plus stable et une exécution de tâches renforcée. Il convient aux conversations complexes, à la génération de contenu, aux questions-réponses de connaissances, à l'analyse commerciale, à l'aide au codage et aux tâches d'automatisation en plusieurs étapes.
Luna Pro est particulièrement adapté aux expériences produit où la qualité de sortie et l'expérience utilisateur comptent, comme les assistants d'écriture professionnels, les assistants IA d'entreprise, le support client, les systèmes de base de connaissances et les flux de travail d'agents. C'est un bon choix lorsque la tâche nécessite plus de fiabilité que le modèle Luna standard.
Date de sortie
9 juil. 2026
Entrée$1 / M tokens
Sortie$6 / M tokens
Lecture cache$0.1 / M tokens
DeepSeek V4 Pro reprend les éléments mis en avant par les sources : MoE 1.6T total / 49B actifs, 1M-token contexte, hybrid long contextee attention. Sa valeur principale se situe dans avancé raisonnement, programmation, base de code complète analyse and longue durée flux de travail agents. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
24 avr. 2026
Entrée$1.2857 / M tokens
Sortie$3.8571 / M tokens
Lecture cache$0.0429 / M tokens
GLM-5.2 est le modèle fondation phare de Z.ai pour les tâches d’ingénierie de longue durée. Il met l’accent sur une fenêtre de contexte réellement exploitable de 1M de tokens, capable de traiter du code, de la documentation et du contexte système à l’échelle d’un projet. Il vise des workflows complets, de l’analyse des exigences à l’implémentation, aux tests et au déploiement multi-plateforme, avec une exécution agentique plus stable.
Date de sortie
13 juin 2026
Entrée$1.1429 / M tokens
Sortie$4 / M tokens
Lecture cache$0.2857 / M tokens
DeepSeek V4 Flash reprend les éléments mis en avant par les sources : MoE 284B total / 13B actifs, 1M-token contexte, inférence orientée débit. Sa valeur principale se situe dans grand volume appels de production, rapide long contextee traitement and sensible aux coûts automatisation. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
24 avr. 2026
Entrée$0.4286 / M tokens
Sortie$1.2857 / M tokens
Lecture cache$0.0143 / M tokens
Claude Opus 5 est le modèle phare d'Anthropic pour le raisonnement exigeant, le codage et le travail agentique à long terme. Il est particulièrement performant pour les tâches logicielles de bout en bout, la revue de code et la recherche de bugs, l'analyse visuelle de graphiques et de documents, les livrables bureautiques complexes et la coordination de sous-agents parallèles. Le modèle maintient un fort respect des instructions et une utilisation des outils sur des tâches étendues, tout en restant efficace pour des efforts moindres dans les charges de travail privilégiant la latence et l'efficacité des tokens.
Date de sortie
24 juil. 2026
Entrée$5 / M tokens
Sortie$25 / M tokens
Lecture cache$0.5 / M tokens
Variante en mode rapide d'Opus 5 - capacités identiques avec une vitesse de sortie plus élevée, au prix double par rapport à l'Opus 5 standard.
En savoir plus dans la documentation d'Anthropic : https://platform.claude.com/docs/en/build-with-claude/fast-mode
Date de sortie
24 juil. 2026
Entrée$10 / M tokens
Sortie$50 / M tokens
Lecture cache$1 / M tokens
Grok 4.6 est le modèle de raisonnement avancé de xAI, conçu pour la programmation complexe, les tâches d’agent de longue durée et le travail de connaissances. Il prend en charge les entrées texte et image, un contexte allant jusqu’à 500 000 jetons, et une intensité de raisonnement configurable (faible, moyenne, élevée, très élevée). Avec l’appel de fonctions, la recherche sur le Web et X, l’exécution de code et la sortie structurée, Grok 4.6 est optimisé pour l’analyse multi-codebase, l’utilisation soutenue d’outils en plusieurs étapes, l’auto-vérification et les flux de travail d’ingénierie de bout en bout. Il est avant tout un modèle de raisonnement et d’agent à usage général, pas simplement un chatbot associé à la plateforme X.
Date de sortie
12 août 2026
Entrée$2 / M tokens
Sortie$6 / M tokens
Lecture cache$0.3 / M tokens
Gemini 3.6 Flash est un modèle haute efficacité de Google pour le codage, les flux de travail agentiques et le développement web et d'applications. Il est conçu pour produire des résultats soignés avec moins de modifications inutiles et moins d'hésitations, tout en réduisant l'utilisation de tokens et le nombre d'appels au modèle nécessaires pour accomplir une tâche.
Date de sortie
21 juil. 2026
Entrée$1.5 / M tokens
Sortie$7.5 / M tokens
Lecture cache$0.15 / M tokens
Grok 4.5 est le modèle de raisonnement de xAI conçu pour la programmation, les tâches d'agent et le travail de connaissance. Il prend en charge les entrées textuelles et images, un contexte allant jusqu'à 500 000 tokens, et une intensité de raisonnement configurable (faible/moyenne/élevée). Il prend en charge les appels de fonctions, la recherche sur le Web et X, l'exécution de code et les sorties structurées, ce qui le rend adapté à l'analyse de longs contextes, aux appels d'outils en plusieurs étapes et aux workflows d'ingénierie de bout en bout. Il ne doit pas être considéré uniquement comme un chatbot associé à la plateforme X.
Date de sortie
8 juil. 2026
Entrée$2 / M tokens
Sortie$6 / M tokens
Lecture cache$0.3 / M tokens
Qwen3.7 Plus reprend les éléments mis en avant par les sources : text+image input, vision-language upgrade, hybrid agent capability. Sa valeur principale se situe dans tâches GUI, navigation mobile, référence visuelle flux de travail and économique Qwen3.7 use. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
2 juin 2026
Entrée$0.2857 / M tokens
Sortie$1.1429 / M tokens
Lecture cache$0.0571 / M tokens
GPT-4.1 reprend les éléments mis en avant par les sources : improved programmation, instruction following and long contexte versus earlier GPT-4 generation. Sa valeur principale se situe dans outils développeurs, assistance de programmation and riches en instructions tasks. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
14 avr. 2025
Entrée$2 / M tokens
Sortie$8 / M tokens
Lecture cache$0.5 / M tokens
GPT-4.1 Mini reprend les éléments mis en avant par les sources : rapideer/lower-cost GPT-4.1 variant. Sa valeur principale se situe dans grand volume developer features, génération structurée and extraction. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
14 avr. 2025
Entrée$0.4 / M tokens
Sortie$1.6 / M tokens
Lecture cache$0.1 / M tokens
GPT-4o reprend les éléments mis en avant par les sources : multimodal GPT-4o flagship, text/image input and broad general intelligence. Sa valeur principale se situe dans applications vision-langage, interaction naturelle and tâches d’assistant général. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
13 mai 2024
Entrée$2.5 / M tokens
Sortie$10 / M tokens
Lecture cache$1.25 / M tokens
GPT-4o Mini reprend les éléments mis en avant par les sources : small affordable GPT-4o model with text/image input and structuré output support. Sa valeur principale se situe dans léger multimodal production, fine-tuning, distillation and tâches ciblées. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
18 juil. 2024
Entrée$0.15 / M tokens
Sortie$0.6 / M tokens
Lecture cache$0.075 / M tokens