Ce 3 août 2026, Amazon Web Services a publié son compte rendu hebdomadaire d'annonces pour Amazon Bedrock avec un élément structurant pour les entreprises déployant des modèles OpenAI en production : les baisses de prix annoncées par OpenAI fin juillet sont désormais répercutées sur la plateforme AWS. GPT-5.6 Luna affiche une réduction de 80 % sur Bedrock, Terra de 20 %. Cette mise à jour ne change pas la liste des modèles disponibles, mais modifie fondamentalement la comparaison économique entre Bedrock et l'API OpenAI directe.
En parallèle, OpenAI a confirmé dans ses notes de version la dépréciation prochaine d'Atlas — son outil de navigation web autonome pour les agents —, fixée au 9 août 2026. L'outil est progressivement absorbé par les capacités agentiques intégrées à ChatGPT et à Codex.
Ces deux signaux combinés dessinent une tendance claire : OpenAI simplifie son catalogue tout en élargissant la distribution de ses modèles via AWS. Pour les équipes ayant des workloads en production, deux décisions concrètes se posent avant la rentrée. Notre analyse des tarifs directs OpenAI du 30 juillet reste le point de départ ; cet article couvre spécifiquement la dimension AWS et les dépréciations.
La grille tarifaire AWS Bedrock au 3 août 2026
Avant le 3 août 2026, les modèles OpenAI disponibles sur Amazon Bedrock étaient facturés à des tarifs légèrement supérieurs à ceux de l'API directe OpenAI, pour tenir compte du surcoût d'infrastructure AWS et des garanties contractuelles additionnelles. La mise à jour du 3 août aligne les deux canaux.
Tarifs actualisés sur Bedrock
GPT-5.6 Luna affiche désormais une réduction de 80 % sur Bedrock, passant d'environ 6 $ à 1,20 $ par million de tokens en entrée. GPT-5.6 Terra enregistre une réduction de 20 % par rapport à son tarif précédent sur la plateforme.
Ces chiffres sont cohérents avec les annonces OpenAI du 30 juillet sur son propre réseau API. La parité tarifaire entre les deux canaux est la nouveauté structurante de cette mise à jour.
L'impact financier concret
Pour un projet traitant 100 millions de tokens par mois avec Luna, le coût mensuel sur Bedrock passe de l'ordre de 600 $ à environ 120 $ — soit une économie de 480 $ par mois sur ce seul modèle. À l'échelle d'un déploiement multi-services pour une ETI, l'impact cumulé sur l'année est significatif. Terra reste le modèle de référence pour les usages sensibles à la latence (agents en streaming, interactions temps réel), avec une réduction plus modeste mais qui s'accumule sur des volumes importants.
Bedrock vs API OpenAI directe : ce qui diffère réellement
La parité tarifaire ouvre une question légitime : pourquoi passer par Bedrock si l'API directe est au même prix ? La réponse dépend de votre contexte d'infrastructure et de vos contraintes de conformité.
Les avantages de Bedrock qui restent valables
Facturation AWS unifiée : un seul fournisseur, un seul contrat, une seule ligne de facture AWS. Ce point simplifie la gouvernance achats dans les grandes organisations et les ETI ayant déjà un volume AWS significant.
Conformité des données : par défaut, Amazon Bedrock ne retransmet pas les prompts et les réponses aux fournisseurs de modèles à des fins d'entraînement. C'est un avantage réel pour les entreprises traitant des données sensibles — informations clients, données RH, documents financiers.
IAM et VPC : l'accès aux modèles est contrôlable via AWS Identity and Access Management, avec des restrictions par rôle, par projet ou par environnement. Les appels peuvent transiter via un VPC privé sans exposition réseau publique.
SLA AWS : Bedrock bénéficie des engagements de disponibilité contractuels AWS standard, utiles pour les usages production avec obligation de service.
Les limites à ne pas ignorer
Les derniers modèles OpenAI arrivent parfois sur Bedrock quelques semaines après l'API directe. Certaines fonctionnalités spécifiques à l'écosystème OpenAI — Assistants API version avancée, Responses API en streaming enrichi — ne sont pas toujours disponibles via Bedrock avec la même parité fonctionnelle.
Pour des projets d'automatisation métier utilisant des pipelines IA sur infrastructure AWS, Bedrock est désormais la solution à prioriser. Pour des expérimentations rapides ou des usages consommant des fonctionnalités en avant-première, l'API directe reste pertinente.
Atlas déprécié le 9 août : fonctions alternatives et migration
Atlas, l'outil d'agents navigateurs d'OpenAI — qui permettait à des agents IA de contrôler un navigateur web de façon autonome (remplir des formulaires, extraire des données, naviguer sur des interfaces) — sera déprécié le 9 août 2026, selon les notes de version publiées par OpenAI.
Pourquoi OpenAI déprécie Atlas
Les fonctionnalités de navigation web sont progressivement intégrées directement dans ChatGPT et dans Codex. Atlas devient redondant au regard de ces capacités natives, et sa maintenance en tant qu'outil séparé n'est plus justifiée. Cette consolidation suit la tendance générale à intégrer les capacités agentiques dans les interfaces principales plutôt que de les proposer comme modules distincts.
Les alternatives disponibles
OpenAI oriente les équipes vers les outils de navigation web disponibles dans les Responses API : les capacités computer_use et web_search intégrées constituent les remplaçants directs. Les agents basés sur Codex bénéficient des mêmes capacités de navigation via l'interface unifiée de la plateforme.
Plan de migration
Pour les équipes ayant intégré Atlas dans leurs workflows via l'Assistants API, les appels doivent être migrés avant le 9 août. Dans le contexte d'une architecture d'automatisation métier incluant du web scraping, de l'extraction de données structurées ou de la navigation guidée, le remplacement est techniquement accessible en quelques jours pour une équipe expérimentée. L'Atlas Fast Mode Sol, variante de performance d'Atlas, est également concerné par la dépréciation du 9 août.
La consolidation du catalogue OpenAI en août : ce qui disparaît
Au-delà d'Atlas, OpenAI procède à un nettoyage plus large de son catalogue en août 2026. Ce mouvement s'inscrit dans une stratégie annoncée depuis fin 2025 : réduire la fragmentation des produits, converger sur une hiérarchie lisible et intégrer les capacités agentiques dans les interfaces principales.
Le retrait d'o3 de ChatGPT le 26 août
OpenAI o3, disponible dans ChatGPT depuis début 2026, sera retiré de l'interface ChatGPT le 26 août 2026, selon les notes de version de la plateforme. Ce retrait concerne principalement l'accès via l'interface ChatGPT — les modèles o3-mini et o4-mini continuent d'être disponibles via l'API, et les versions o3-pro et o4-pro restent accessibles dans les plans payants.
Ce que cette consolidation signifie pour vos intégrations
La multiplication des modèles et des outils distincts avait généré de la confusion et des coûts de maintenance pour les équipes de développement. La simplification en cours — bien qu'elle impose des migrations à court terme — est cohérente avec une maturité de la plateforme : moins de modèles à évaluer, moins d'outils à maintenir, des capacités consolidées dans des points d'accès standardisés. Pour les décideurs techniques, c'est un signal positif sur la prévisibilité du catalogue à 12-18 mois.
Arbitrage pour les équipes en production
Pour les équipes techniques utilisant des modèles OpenAI en production, deux décisions concrètes se posent avant la rentrée.
Avant le 9 août : auditer les dépendances Atlas
Vérifier si vos applications utilisent Atlas ou un outil de navigation web basé sur l'Assistants API d'OpenAI. Si oui, planifier la migration vers les Responses API ou Codex maintenant. Le délai est court mais la migration technique est accessible pour une équipe expérimentée. Une application qui ignore cette dépréciation sera en erreur à partir du 9 août.
D'ici fin août : revoir la stratégie de distribution des modèles
Comparer les nouveaux tarifs Bedrock et API directe pour les modèles OpenAI utilisés en production. Si l'environnement est AWS et que les données traitées ont une sensibilité métier (données clients, informations RH, documents contractuels), le basculement sur Bedrock est désormais économiquement neutre — les bénéfices (conformité des données, IAM, facturation unifiée) sont acquis sans surcoût par rapport à l'API directe.
Pour les PME qui n'ont pas encore démarré
Pour les PME et ETI qui n'ont pas encore de stratégie IA structurée, cette consolidation du catalogue OpenAI est en réalité une simplification du paysage : moins de modèles à comparer, moins d'outils à évaluer, des tarifs qui convergent. C'est un contexte favorable pour démarrer un premier projet concret d'outil interne sur mesure ou de pipeline d'automatisation, avec des coûts d'inférence qui n'ont jamais été aussi bas. Pour cadrer vos besoins, prenez contact avec notre équipe.
FAQ — OpenAI consolide son catalogue en août 2026 : Luna à -80 % sur Amazon Bedrock, Atlas déprécié le 9 août — points de vigilance pour les équipes en production
Amazon Bedrock propose-t-il tous les modèles OpenAI disponibles en API directe ?
Non, pas toujours avec la même simultanéité. Les modèles OpenAI arrivent généralement sur Bedrock quelques jours à quelques semaines après leur disponibilité sur l'API directe. Au 3 août 2026, GPT-5.6 Luna et Terra sont disponibles sur Bedrock aux nouveaux tarifs réduits. Les modèles les plus récents ou en bêta limitée peuvent ne pas encore être accessibles via Bedrock.
La migration depuis Atlas vers les Responses API est-elle complexe à réaliser ?
Pour la majorité des cas d'usage courants (navigation web, extraction de données, remplissage de formulaires), la migration est accessible en quelques jours pour une équipe de développement expérimentée. Les Responses API d'OpenAI proposent des fonctionnalités equivalentes via les outils web_search et computer_use. La complexité augmente si le workflow Atlas exploite des fonctionnalités très spécifiques ou des combinaisons d'outils non standard — dans ce cas, prévoir une semaine de refactoring et de tests.
Les données envoyées via Amazon Bedrock restent-elles dans l'infrastructure AWS sans passer chez OpenAI ?
Par défaut, Amazon Bedrock n'envoie pas les inputs et outputs à des fins d'entraînement des modèles fournisseurs. Les données transitent via l'infrastructure AWS et sont soumises aux engagements contractuels AWS en matière de confidentialité. Cette garantie est différente de l'API directe OpenAI, où les conditions d'utilisation peuvent prévoir un usage des données pour l'amélioration des modèles selon le type de plan souscrit. C'est un point à vérifier avec vos équipes juridiques selon la sensibilité des données traitées.
La dépréciation d'o3 dans ChatGPT le 26 août affecte-t-elle les accès API existants ?
Non, la dépréciation d'o3 annoncée pour le 26 août concerne uniquement l'accès via l'interface ChatGPT. Les intégrations via l'API OpenAI utilisant les modèles o3-mini, o4-mini ou o3-pro ne sont pas concernées par cette date. Les versions API continuent d'être supportées selon leurs propres calendriers de dépréciation, à vérifier dans la documentation officielle OpenAI.
Faut-il migrer vers Bedrock si on utilise déjà l'API OpenAI directe en production ?
Pas nécessairement — cela dépend de votre contexte. Si votre infrastructure est principalement AWS, que vous traitez des données sensibles et que la facturation unifiée AWS est un avantage organisationnel, Bedrock est désormais sans surcoût par rapport à l'API directe. Si votre stack est multicloud ou que vous avez besoin de fonctionnalités en avant-première, l'API directe reste pertinente. La migration n'est pas urgente mais mérite une évaluation d'ici la fin du trimestre, maintenant que la parité tarifaire est établie.