Kimi K3 est un modèle d'IA haute performance conçu pour le raisonnement avancé, le codage et l'exécution de tâches complexes. Il offre des performances solides sur les projets de programmation à grande échelle, la résolution de problèmes en plusieurs étapes et les applications à forte intensité de connaissances. Avec une gestion étendue du contexte et des capacités multimodales, K3 est adapté à la création d'agents IA puissants, d'outils développeurs et d'applications d'entreprise.
Date de sortie
16 juil. 2026
Entrée$2.8571 / M tokens
Sortie$14.2857 / M tokens
Lecture cache$0.2857 / M tokens
GPT-5.5 reprend les éléments mis en avant par les sources : frontier OpenAI model, stronger programmation/recherche/analyse de données profile. Sa valeur principale se situe dans broad professional intelligence and structuré travail de connaissance. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
23 avr. 2026
Entrée$5 / M tokens
Sortie$30 / M tokens
Lecture cache$0.5 / M tokens
DeepSeek V4 Pro reprend les éléments mis en avant par les sources : MoE 1.6T total / 49B actifs, 1M-token contexte, hybrid long contextee attention. Sa valeur principale se situe dans avancé raisonnement, programmation, base de code complète analyse and longue durée flux de travail agents. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
24 avr. 2026
Entrée$1.8 / M tokens
Sortie$3.5 / M tokens
Lecture cache$0.015 / M tokens
DeepSeek V4 Flash reprend les éléments mis en avant par les sources : MoE 284B total / 13B actifs, 1M-token contexte, inférence orientée débit. Sa valeur principale se situe dans grand volume appels de production, rapide long contextee traitement and sensible aux coûts automatisation. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
24 avr. 2026
Entrée$0.15 / M tokens
Sortie$0.3 / M tokens
Lecture cache$0.003 / M tokens
Qwen3.7 Plus reprend les éléments mis en avant par les sources : text+image input, vision-language upgrade, hybrid agent capability. Sa valeur principale se situe dans tâches GUI, navigation mobile, référence visuelle flux de travail and économique Qwen3.7 use. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
2 juin 2026
Entrée$0.2857 / M tokens
Sortie$1.1429 / M tokens
Lecture cache$0.0571 / M tokens
GPT-4.1 reprend les éléments mis en avant par les sources : improved programmation, instruction following and long contexte versus earlier GPT-4 generation. Sa valeur principale se situe dans outils développeurs, assistance de programmation and riches en instructions tasks. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
14 avr. 2025
Entrée$2 / M tokens
Sortie$8 / M tokens
Lecture cache$0.5 / M tokens
GPT-4.1 Mini reprend les éléments mis en avant par les sources : rapideer/lower-cost GPT-4.1 variant. Sa valeur principale se situe dans grand volume developer features, génération structurée and extraction. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
14 avr. 2025
Entrée$0.4 / M tokens
Sortie$1.6 / M tokens
Lecture cache$0.1 / M tokens
GPT-4o reprend les éléments mis en avant par les sources : multimodal GPT-4o flagship, text/image input and broad general intelligence. Sa valeur principale se situe dans applications vision-langage, interaction naturelle and tâches d’assistant général. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
13 mai 2024
Entrée$2.5 / M tokens
Sortie$10 / M tokens
Lecture cache$1.25 / M tokens
GPT-4o Mini reprend les éléments mis en avant par les sources : small affordable GPT-4o model with text/image input and structuré output support. Sa valeur principale se situe dans léger multimodal production, fine-tuning, distillation and tâches ciblées. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
18 juil. 2024
Entrée$0.15 / M tokens
Sortie$0.6 / M tokens
Lecture cache$0.075 / M tokens
GPT-5.3 Chat est le nom API de GPT-5.3 Instant, un snapshot de ChatGPT conçu pour rendre les conversations quotidiennes plus fluides, directes et utiles. OpenAI présente cette version comme une amélioration de la précision, de la contextualisation lors des recherches web et du flux conversationnel, avec moins de réserves inutiles et de formulations trop prudentes. La documentation API indique toutefois que ce modèle est déprécié au profit de modèles GPT plus récents.
Date de sortie
3 mars 2026
Entrée$1.75 / M tokens
Sortie$14 / M tokens
Lecture cache$0.175 / M tokens
GPT-5.3-Codex est le modèle de codage agentique d’OpenAI pour Codex et les environnements de développement similaires. Il combine des performances avancées en ingénierie logicielle avec un raisonnement plus large et des connaissances professionnelles, tout en prenant en charge différents niveaux d’effort de raisonnement. OpenAI le positionne au-delà de la simple écriture ou revue de code, vers l’usage d’ordinateur, les workflows terminal et les tâches d’ingénierie longues.
Date de sortie
5 févr. 2026
Entrée$1.75 / M tokens
Sortie$14 / M tokens
Lecture cache$0.175 / M tokens
GPT-5.4 reprend les éléments mis en avant par les sources : frontier work model, native computer use, documents/tableurs/présentations, large contexte. Sa valeur principale se situe dans professional productivity, programmation, analyse factuelle and exécution de travail réel. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
5 mars 2026
Entrée$2.5 / M tokens
Sortie$15 / M tokens
Lecture cache$0.25 / M tokens
GPT-5.4 Mini reprend les éléments mis en avant par les sources : smaller/rapideer GPT-5.4 variant with utilisation d’outils and raisonnement multimodal. Sa valeur principale se situe dans faible latence production tasks, sous-agents and bien délimité programmation flux de travail. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
17 mars 2026
Entrée$0.75 / M tokens
Sortie$4.5 / M tokens
Lecture cache$0.075 / M tokens
GPT-5.4 Nano reprend les éléments mis en avant par les sources : smallest/lowest-cost GPT-5.4 option. Sa valeur principale se situe dans classification, routage, extraction and prévisible grand volume generation. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
17 mars 2026
Entrée$0.2 / M tokens
Sortie$1.25 / M tokens
Lecture cache$0.02 / M tokens
GPT-5.4 Pro reprend les éléments mis en avant par les sources : higher-precision GPT-5.4 tier. Sa valeur principale se situe dans demanding analyse, complex code and high-stakes résultats professionnels. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
5 mars 2026
Entrée$30 / M tokens
Sortie$180 / M tokens
GPT-5.5 Pro reprend les éléments mis en avant par les sources : higher-compute GPT-5.5 tier, precision-first raisonnement. Sa valeur principale se situe dans travail professionnel difficile, programmation, recherche, analyse de données and riches en documents tasks. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Date de sortie
23 avr. 2026
Entrée$30 / M tokens
Sortie$180 / M tokens
GPT-5.6 Luna est la version polyvalente de la gamme Luna, adaptée aux applications IA quotidiennes. Il peut être utilisé pour le chat Q&R, la réécriture de textes, le résumé, l'extraction d'informations, le raisonnement simple, l'assistance au codage et l'automatisation bureautique.
Luna est un choix pratique pour les prototypes, les fonctionnalités métier légères, le traitement de contenu par lots et les scénarios courants d'interaction utilisateur. C'est un bon modèle de départ lorsque la vitesse, la simplicité et le contrôle des coûts sont importants ; pour les tâches nécessitant une qualité supérieure ou des résultats plus stables, vous pouvez envisager Luna Pro.
Date de sortie
9 juil. 2026
Entrée$1 / M tokens
Sortie$6 / M tokens
Lecture cache$0.1 / M tokens
GPT-5.6 Luna Pro est la version améliorée de la série Luna, destinée à fournir des réponses de meilleure qualité, un suivi d'instructions plus stable et une exécution de tâches renforcée. Il convient aux conversations complexes, à la génération de contenu, aux questions-réponses de connaissances, à l'analyse commerciale, à l'aide au codage et aux tâches d'automatisation en plusieurs étapes.
Luna Pro est particulièrement adapté aux expériences produit où la qualité de sortie et l'expérience utilisateur comptent, comme les assistants d'écriture professionnels, les assistants IA d'entreprise, le support client, les systèmes de base de connaissances et les flux de travail d'agents. C'est un bon choix lorsque la tâche nécessite plus de fiabilité que le modèle Luna standard.
Date de sortie
9 juil. 2026
Entrée$1 / M tokens
Sortie$6 / M tokens
Lecture cache$0.1 / M tokens
GPT-5.6 Sol est la version standard de la série Sol. Elle convient aux questions-réponses générales, au traitement de texte, à la rédaction de contenus, au résumé, à l’assistance légère en programmation et aux tâches d’automatisation métier.
Sol est conçue pour les scénarios qui nécessitent de solides capacités générales tout en tenant compte de l’efficacité de réponse et des coûts. Elle peut être utilisée pour les fonctionnalités produit, les assistants conversationnels, les outils de génération de contenu, le nettoyage de données, les Q&A sur base de connaissances et les traitements par lots. Pour un usage à grande échelle ou un prototypage rapide, Sol offre un point de départ flexible.
Date de sortie
9 juil. 2026
Entrée$5 / M tokens
Sortie$30 / M tokens
Lecture cache$0.5 / M tokens
GPT-5.6 Sol Pro est la version Pro de la série Sol, conçue pour les tâches complexes et une sortie de haute qualité. Il convient à la rédaction avancée, aux questions-réponses précises, au raisonnement commercial, à la génération de code, à l'analyse structurée et à l'exécution de tâches multi-tours.
Sol Pro est adapté aux tâches qui exigent une plus grande précision, une compréhension contextuelle et l'achèvement des instructions. Il peut être utilisé pour la production de contenu professionnel, les assistants d'analyse de données, les systèmes de questions-réponses de connaissances, les flux de travail d'agents complexes et les outils d'IA d'entreprise internes.
Date de sortie
9 juil. 2026
Entrée$5 / M tokens
Sortie$30 / M tokens
Lecture cache$0.5 / M tokens
GPT-5.6 Terra est la version polyvalente de la série Terra. Elle convient aux conversations quotidiennes, à la génération de texte, au résumé, à l'extraction d'informations, au raisonnement léger et à l'assistance au codage.
Terra offre un équilibre pratique entre capacités générales, efficacité de réponse et coût. Elle peut être utilisée pour des assistants conversationnels, des outils de contenu, l'automatisation bureautique, des questions-réponses sur base de connaissances et des workflows de traitement de texte par lots. Pour des itérations rapides ou des applications sensibles aux coûts, Terra est un excellent choix par défaut au sein de la série Terra.
Date de sortie
9 juil. 2026
Entrée$2.5 / M tokens
Sortie$15 / M tokens
Lecture cache$0.275 / M tokens