Le 22 août 2026, OpenAI a annoncé une baisse de prix significative sur GPT-5.6 Sol, son modèle frontier premium. Le coût des tokens d'entrée passe de 5 $ à 4 $ par million (−20 %), le coût des tokens de sortie de 30 $ à 20 $ par million (−33 %) et l'entrée mise en cache de 0,50 $ à 0,40 $ par million (−20 %). La réduction est promotionnelle : elle est effective immédiatement et court jusqu'au 21 novembre 2026, soit trois mois de remise garantie.
C'est la première baisse de prix notable sur Sol depuis son lancement en disponibilité générale début juillet 2026. En juillet, c'est Luna — le modèle le plus léger de la gamme GPT-5.6 — qui avait bénéficié d'une réduction bien plus prononcée (-80 % en quelques semaines). Sol, le modèle de pointe, sort donc de sa position de modèle frontier le plus cher de la gamme OpenAI : il s'inscrit désormais en dessous de Claude Opus 5 d'Anthropic sur les deux dimensions clés, entrée et sortie.
Pour les équipes qui utilisent l'API OpenAI directement — dans des projets de développement sur mesure ou d'automatisation métier —, cette fenêtre de trois mois représente une opportunité concrète de réduire la facture ou de tester Sol sur des volumes jusqu'alors jugés trop coûteux. Encore faut-il comprendre exactement qui en bénéficie et sous quelles conditions.
Grille tarifaire : avant et après le 22 août
Résumé immédiat : GPT-5.6 Sol voit son prix de sortie baisser d'un tiers et son prix d'entrée baisser d'un cinquième. La mise en cache (prompt caching) suit la même trajectoire que l'entrée standard.
- Tokens d'entrée : 5,00 $ → 4,00 $ par million (−20 %)
- Tokens de sortie : 30,00 $ → 20,00 $ par million (−33 %)
- Entrée mise en cache : 0,50 $ → 0,40 $ par million (−20 %)
Pour rappel, la gamme GPT-5.6 comprend trois niveaux : Luna (le plus léger et le moins cher), Terra (intermédiaire, balancé) et Sol (le plus puissant). Les baisses annoncées ne concernent que Sol. Luna et Terra conservent leurs tarifs actuels — Luna ayant déjà été massivement réduit en juillet, et Terra restant dans sa fourchette historique.
L'asymétrie entre la baisse en entrée (−20 %) et la baisse en sortie (−33 %) est importante pour calibrer les économies réelles. Les charges de travail qui génèrent beaucoup de tokens de sortie — résumés longs, rapports automatisés, rédaction assistée, génération de code étendue — voient un gain proportionnellement plus élevé que les tâches majoritairement en entrée, comme l'analyse de documents ou la classification.
Pour les projets qui utilisent le prompt caching (réutilisation de contextes longs entre les requêtes), le gain est identique à celui de l'entrée standard : −20 %. Les équipes qui ont déjà mis en place des stratégies de caching pour réduire les coûts (voir notre guide sur le prompt caching) trouveront la combinaison des deux leviers particulièrement efficace.
Qui est éligible et jusqu'à quand
Réponse directe : La promotion s'applique aux utilisateurs de l'API OpenAI en pay-as-you-go, aux crédits Codex et aux crédits ChatGPT Work. Elle ne s'applique pas aux abonnements Pro, Plus et Business, dont les tarifs restent inchangés.
Ce qui est couvert
- API OpenAI (pay-as-you-go) : tout appel à l'endpoint gpt-5.6-sol au tarif réduit, immédiatement et sans action de votre part. Les crédits prépayés existants sont consommés aux nouveaux tarifs.
- Crédits Codex : les équipes qui utilisent Codex — l'outil de génération et de révision de code d'OpenAI — et qui font appel à Sol bénéficient de la même réduction.
- Crédits ChatGPT Work : les plans Work éligibles voient leurs crédits valorisés aux nouveaux prix, ce qui augmente mécaniquement leur capacité d'usage sur la durée de la promotion.
Ce qui n'est pas couvert
- Abonnements ChatGPT Pro, Plus, Business : les forfaits mensuels à tarif fixe ne changent pas. L'accès à Sol via ces abonnements reste le même, mais la facturation à l'usage ne s'applique pas dans ces formules.
- Après le 21 novembre 2026 : OpenAI a qualifié cette réduction de promotionnelle. Les tarifs peuvent revenir à leur niveau antérieur (5 $ / 30 $ / 0,50 $ par million de tokens) ou évoluer différemment après cette date. Aucun engagement de prolongation n'a été annoncé.
La réduction est automatique pour les comptes API existants : aucune action d'activation n'est requise. Pour les équipes qui facturent des projets à leurs clients sur la base des coûts d'inférence, il convient de revoir les devis en cours pour éviter de sous-facturer ou de sur-facturer.
Positionnement concurrentiel : Sol désormais sous Claude Opus 5
Le fait marquant : GPT-5.6 Sol était jusqu'au 21 août le modèle frontier le plus onéreux de la gamme OpenAI. Avec cette baisse, il passe sous Claude Opus 5 d'Anthropic sur les deux dimensions tarifaires — entrée et sortie.
Le marché des modèles frontier s'est fortement restructuré depuis le printemps 2026. En juillet, la baisse de Luna à −80 % signalait déjà une pression concurrentielle sur les modèles légers, alimentée notamment par DeepSeek V4-Pro et les modèles Qwen3 d'Alibaba. La baisse de Sol en août indique que cette pression monte désormais vers le segment premium.
Pour les équipes qui hésitaient entre Sol et Claude Opus 5 sur des critères purement économiques, la donne a changé. Sol bénéficiait déjà d'un avantage en termes de vitesse d'inférence — la version Ultrafast sur Cerebras atteignant des débits très élevés — mais pâtissait de sa position tarifaire relative face à Opus 5. Ce rééquilibrage élargit les cas d'usage où Sol est compétitif.
Il reste pertinent d'évaluer les deux modèles sur des critères qualité sur vos tâches réelles, et pas seulement sur le prix. Les benchmarks génériques (coding, math, science) ne reflètent pas nécessairement les performances sur vos documents métier, votre jargon sectoriel ou vos flux d'agents. Le choix entre Sol et Opus 5 dépend aussi de l'écosystème : si vous êtes déjà intégrés sur les outils OpenAI (Codex, ChatGPT Work, Azure OpenAI), la bascule est moins coûteuse que si vous êtes sur une infrastructure Anthropic.
Calcul d'économies réelles pour vos projets
Pour chiffrer rapidement : l'économie principale vient des tokens de sortie (−33 %). Pour un projet générant 10 millions de tokens de sortie par mois, le gain mensuel est de 100 $ ; sur les trois mois de la promotion, c'est 300 $. Pour un volume de 100 millions de tokens de sortie mensuel, l'économie atteint 1 000 $ par mois soit 3 000 $ sur la période.
Exemples concrets selon le type de projet
- Assistant documentaire (forte entrée, faible sortie) : si vous traitez 50 millions de tokens d'entrée pour 5 millions de sortie par mois, l'économie est de (50M × 1 $/M) + (5M × 10 $/M) = 50 $ + 50 $ = 100 $/mois, soit 300 $ sur la promo. Le ratio d'entrée/sortie joue fortement ici.
- Génération de rapports ou de code (forte sortie) : avec 10 millions de tokens d'entrée et 30 millions de sortie par mois, l'économie est de (10M × 1 $/M) + (30M × 10 $/M) = 10 $ + 300 $ = 310 $/mois, soit 930 $ sur trois mois. Ce type de charge de travail bénéficie le plus de la baisse asymétrique.
- Pipeline d'agents multi-étapes : les architectures agents enchaînent souvent plusieurs appels LLM avec des contextes intermédiaires longs. Sur un volume de 20 millions de tokens d'entrée et 20 millions de sortie par mois, l'économie est de (20M × 1 $/M) + (20M × 10 $/M) = 220 $/mois, soit 660 $ sur la promo.
Ces calculs supposent une utilisation exclusive de Sol. En pratique, les architectures multi-modèles — où Sol traite les tâches complexes et Luna ou Terra les tâches de routine — permettent d'optimiser davantage. La promotion Sol s'additionne alors aux tarifs déjà bas de Luna.
Pour les projets d'outils internes sur mesure qui intègrent Sol comme couche de raisonnement, il est recommandé de recalculer le coût d'exploitation mensuel avec les nouveaux tarifs et d'ajuster les projections de ROI si elles avaient été établies avant le 22 août.
Comment tirer parti de la fenêtre promotionnelle
Point de départ : la promotion expire le 21 novembre 2026. Trois mois, c'est court pour redesigner une architecture, mais c'est suffisant pour tester Sol sur des charges de travail qui lui étaient jusqu'ici économiquement inaccessibles, et pour constituer une base de données de performances réelles avant de décider d'une adoption durable.
Ce qu'il est raisonnable de faire maintenant
- Migrer vos appels API existants vers Sol si vous étiez sur Terra : si vos projets utilisaient Terra pour des raisons de budget et que Sol correspond mieux à vos besoins de qualité, c'est le moment de tester la bascule sur un sous-ensemble du trafic. Mesurez la qualité et le coût réel, et décidez avant novembre si l'adoption post-promo vaut le prix standard.
- Lancer des PoC (proof of concept) coûteux en tokens : certains cas d'usage — analyse de contrats longs, génération de documentation technique complète, agents de recherche multi-sources — étaient difficiles à justifier économiquement sur Sol. La fenêtre actuelle permet de les tester avec un surcoût limité.
- Recalibrer vos devis et projections : si vous vendez des prestations incluant des coûts d'inférence à vos clients, mettez à jour vos grilles tarifaires et précisez la durée de validité (jusqu'au 21 novembre).
Ce qu'il vaut mieux éviter
- Engager une architecture définitive en supposant que le prix reste à 4 $/20 $ : la promotion est explicitement temporaire. Les décisions d'architecture pour 2027 ne doivent pas reposer sur ce tarif promotionnel. Calculez la viabilité aux prix standard pour ne pas vous retrouver dans une impasse en décembre.
- Abandonner les stratégies de caching ou d'optimisation : même à tarif réduit, les bonnes pratiques de prompt caching, de routage intelligent entre modèles et de batching restent pertinentes. Elles amplifient le gain de la promo plutôt que de le rendre superflu.
Pour les équipes qui réfléchissent à leur stratégie d'automatisation métier IA à moyen terme, cette fenêtre est une opportunité de produire des données réelles de coût-performance sur Sol, qui alimenteront des décisions d'architecture plus solides que n'importe quel benchmark public.
FAQ — OpenAI baisse GPT-5.6 Sol de 20 à 33 % à compter du 22 août : Sol passe sous Claude Opus 5 jusqu'au 21 novembre — éligibles, exclus et économies calculées
Quels types d'appels API OpenAI bénéficient de la baisse de prix de GPT-5.6 Sol ?
La réduction s'applique aux appels API OpenAI en pay-as-you-go, aux crédits Codex et aux crédits ChatGPT Work qui utilisent le modèle gpt-5.6-sol. Elle est automatique : aucune action d'activation n'est nécessaire pour les comptes API existants.
Les abonnements ChatGPT Pro, Plus ou Business sont-ils concernés par la promotion ?
Non. Les abonnements mensuels à tarif fixe (Pro, Plus, Business) ne sont pas impactés par cette réduction. Le prix de ces forfaits reste inchangé. La promotion concerne exclusivement l'usage facturation à l'utilisation via l'API, Codex et ChatGPT Work.
GPT-5.6 Sol est-il vraiment moins cher que Claude Opus 5 d'Anthropic maintenant ?
Selon les informations publiées par plusieurs sources le 22 août 2026, oui : avec les nouveaux tarifs (4 $/M en entrée, 20 $/M en sortie), Sol passe sous Claude Opus 5 sur les deux dimensions tarifaires. Il reste néanmoins pertinent de comparer les performances sur vos tâches réelles avant de basculer d'un modèle à l'autre.
Que se passe-t-il si je dépasse la date de fin de promotion le 21 novembre 2026 ?
OpenAI n'a pas annoncé de prolongation. À compter du 22 novembre 2026, les appels à gpt-5.6-sol pourraient revenir aux tarifs antérieurs (5 $/M en entrée, 30 $/M en sortie) ou à tout autre tarif qu'OpenAI communiquera à cette date. Il est conseillé de modéliser vos budgets avec les prix standard pour anticiper l'impact post-promotion.
Luna et Terra bénéficient-ils aussi de baisses de prix en août 2026 ?
Non, la réduction annoncée le 22 août 2026 ne concerne que Sol. Luna avait déjà fait l'objet d'une baisse de -80 % en juillet 2026. Terra conserve ses tarifs actuels. Pour une vue d'ensemble des trois niveaux de la gamme GPT-5.6, consultez notre analyse comparative publiée en juillet.
Faut-il recalculer les devis clients qui incluent des coûts d'inférence GPT-5.6 Sol ?
Oui, si vos devis ou projections ont été établis avant le 22 août 2026. Les coûts d'exploitation sol-based ont baissé de 20 à 33 % selon la distribution entrée/sortie de vos projets. Mettez à jour vos grilles tarifaires et précisez la validité de ces estimations jusqu'au 21 novembre 2026.