OpenAI indique qu’il a baissé le prix de deux modèles GPT-5.6 afin de les rendre plus accessibles. Concrètement, la facture côté API diminue pour Luna et Terra, dans le cadre d’un travail plus large visant à accroître l’efficacité des modèles.
Cette annonce ne se limite pas à un ajustement tarifaire : OpenAI précise aussi que ces nouveaux niveaux de prix influencent la manière dont certaines applications comptent votre utilisation. Si vous utilisez Codex ou ChatGPT Work avec ces modèles, vous pourriez constater que vos quotas sont consommés différemment.
Quels modèles sont concernés par les prix réduits GPT-5.6 ?
Les changements portent sur deux offres basées sur GPT-5.6 :
- Luna : baisse très marquée du coût d’entrée et de sortie.
- Terra : réduction plus modérée, mais toujours notable.
OpenAI présente ces ajustements comme une étape supplémentaire dans la recherche d’une meilleure rentabilité des modèles, tout en maintenant leurs capacités.
Baisse du coût API : Luna (-80% sur l’entrée)
Selon la nouvelle grille tarifaire, GPT-5.6 Luna coûte désormais :
- 0,20 $ par million de tokens d’entrée (contre 1 $ auparavant)
- 1,20 $ par million de tokens de sortie (contre 6 $ auparavant)
Au total, OpenAI met en avant une réduction d’environ 80% sur le prix lié aux tokens d’entrée, et une baisse significative aussi sur les tokens de sortie. L’idée est claire : réduire le coût par tâche, particulièrement lorsque les entrées sont volumineuses.
Terra devient moins cher (-20% sur l’entrée, baisse aussi à la sortie)
Pour GPT-5.6 Terra, la diminution est plus graduelle. D’après OpenAI, les tarifs passent de :
- 2,50 $ à 2 $ par million de tokens d’entrée
- 15 $ à 12 $ par million de tokens de sortie
Autrement dit, Terra bénéficie d’un ajustement à la baisse sur l’ensemble du flux d’utilisation. Même si la réduction annoncée est autour de 20% pour l’entrée, la sortie diminue également, ce qui peut compter dans des scénarios où les réponses sont longues.
Impact sur Codex et ChatGPT Work : comment l’usage est compté
OpenAI explique également que ces prix réduits GPT-5.6 modifient la façon dont l’utilisation est décomptée dans Codex et ChatGPT Work. L’entreprise indique que, dans certains cas, les nouvelles tâches qui emploient ces modèles déduisent moins des allocations des clients.
Le résultat pratique est le suivant : vous pouvez potentiellement réaliser davantage de travail dans un quota identique, puisque chaque tâche consommerait moins d’“allocation” au regard du système de comptabilisation actuel.
OpenAI ne détaille pas ici la formule exacte dans l’annonce citée, mais le message est que la tarification et le calcul d’usage suivent la logique de l’efficacité accrue.
Auto-review et mises à niveau : passage vers Luna en GPT-5.6
En plus des ajustements de prix, OpenAI procède à une mise à niveau de certaines briques d’automatisation. L’entreprise indique que Auto-review dans l’application ChatGPT et Codex CLI passent de GPT-5.4 à GPT-5.6 Luna.
D’après OpenAI, ce changement devrait réduire le coût d’environ dix fois. Pour les équipes qui s’appuient sur ces outils de relecture automatique, l’effet peut être direct : davantage de cycles d’analyse pour un budget inchangé, ou un budget plus faible pour obtenir le même volume de traitement.
GPT-5.6 Sol : un mode Fast plus rapide, sans changement de tarif standard
OpenAI annonce aussi une amélioration de performance pour les clients API via un mode Fast, associé à GPT-5.6 Sol. Toutefois, la société précise qu’il n’y aura pas de modification sur le tarif standard de Sol pour l’instant.
Fast mode : jusqu’à 2,5 fois plus rapide
Le mode Fast de GPT-5.6 Sol peut aller jusqu’à 2,5 fois plus rapide que le traitement standard, sans réduire l’intelligence du modèle selon OpenAI.
L’accélération a un coût : ce mode est au double du prix de l’API standard. Autrement dit, le “Fast” vise avant tout les usages où le temps compte fortement, plutôt que de remplacer systématiquement le mode standard.
Quand choisir le mode Fast ?
OpenAI indique que le mode Fast est particulièrement conçu pour :
- le codage où les itérations doivent être rapides ;
- la recherche avec des délais plus courts ;
- des workloads “agentic”, où des agents enchaînent des étapes et où la latence devient un facteur clé.
En dehors de ces cas, l’entreprise suggère que vous n’avez généralement pas besoin d’activer le mode Fast pour la majorité des scénarios courants.
Pourquoi ces baisses de prix ? Une meilleure efficacité annoncée
OpenAI relie ces évolutions à de récents progrès ayant permis d’obtenir des gains d’efficacité, mentionnés comme à l’origine des réductions appliquées à Luna et Terra. Dans le même temps, l’entreprise met en avant des résultats internes :
- Luna atteindrait le sommet de son index d’intelligence parmi les modèles comparés, malgré un coût par tâche substantiellement plus faible.
L’argument central est donc double : d’un côté, une tarification plus basse ; de l’autre, une performance qui reste compétitive, voire favorable par rapport aux alternatives.
Ce que cela change pour les développeurs et les équipes
Si vous utilisez régulièrement l’API, ces prix réduits GPT-5.6 peuvent influencer votre stratégie. Par exemple, vous pouvez être tenté d’augmenter la taille de vos entrées, la fréquence des appels ou la longueur des sorties, sans nécessairement augmenter le coût total de manière équivalente.
Pour les usages dans Codex et ChatGPT Work, l’impact peut être encore plus concret si le système de comptabilisation d’allocation suit la logique des nouveaux tarifs. Dans ce cas, il ne s’agit pas seulement de payer moins pour le même volume : il pourrait aussi être possible d’en faire davantage dans le même cadre de quota.
Enfin, pour les équipes qui exploitent Auto-review et Codex CLI, le passage vers GPT-5.6 Luna constitue un point important : la promesse est une diminution marquée du coût, ce qui peut encourager davantage de cycles de relecture et de contrôle qualité automatisés.
Conclusion : des prix réduits GPT-5.6 pour plus d’usage
Avec l’annonce de prix réduits GPT-5.6, OpenAI abaisse le coût de Luna et Terra sur l’API, tout en expliquant que cette évolution change également la manière dont certaines plateformes comptent l’utilisation. En parallèle, des outils comme Auto-review et Codex CLI passent vers Luna en GPT-5.6, avec une réduction de coût annoncée environ dix fois.
Si vous pouvez adapter vos workflows, ces ajustements peuvent vous permettre soit d’optimiser votre budget, soit de réaliser davantage de tâches sous les mêmes limites. Quant au mode Fast de Sol, il reste une option ciblée pour les scénarios où la vitesse prime.
