OpenAI vient de publier GPT-6 Astra, son nouveau modèle destiné aux environnements professionnels, accessible via ChatGPT Work, Codex et son interface de programmation. Le tarif affiché en entrée est de dix dollars le million de jetons, contre cinq dollars pour GPT-5.6 Sol, son prédécesseur direct. Sur le papier, la facture double. Dans les faits, la réalité est plus nuancée, et c'est précisément là que réside l'enjeu pour tout revendeur ou intégrateur qui construit une offre de services autour des modèles de langage d'OpenAI.
La dépense réelle d'un modèle de langage ne se lit pas sur un tarif catalogue. Elle se calcule en multipliant le prix unitaire par la consommation effective de jetons sur chaque tâche. Un fournisseur qui réduit la consommation peut relever son prix affiché sans que la facture finale de son client bouge significativement. C'est exactement le pari qu'OpenAI joue avec Astra, et les premiers retours d'intégrateurs commencent à donner des ordres de grandeur.
En résumé
- OpenAI fixe GPT-6 Astra à dix dollars le million de jetons en entrée et cinquante en sortie, soit le double du tarif d'entrée de GPT-5.6 Sol (source : IT Social).
- GitLab, seul intégrateur à publier des mesures d'usage, relève 42,7 % de jetons consommés en moins par exécution par rapport à GPT-5.6 Sol (source : IT Social).
- OpenAI abandonne la segmentation en trois variantes tarifaires introduite en juin et revient à un modèle unique, rapprochant ainsi sa stratégie de celle d'Anthropic.
- Microsoft, qui distribue Astra, applique une grille de prix plus complexe : le tarif d'entrée monte à vingt dollars au-delà des contextes courts, et aucune zone de données européenne n'est disponible à ce stade.
- Le solde financier réel entre la hausse du tarif et la baisse de consommation reste incalculable sans mesure sur les charges propres à chaque organisation.
Fin de la segmentation tarifaire chez OpenAI
En juin dernier, OpenAI avait introduit GPT-5.6 en trois variantes distinctes : Sol à cinq et trente dollars le million de jetons, Terra à mi-prix de la génération précédente, et Luna sur le segment économique. Ce découpage permettait au client de choisir son niveau de performance en changeant de modèle, et donc de maîtriser son curseur coût-qualité. Astra efface cette architecture. Il n'existe plus qu'un seul modèle, à un seul tarif, et c'est le modèle lui-même qui gère l'allocation du calcul selon la complexité de la tâche.
Cette décision rapproche OpenAI de la stratégie qu'Anthropic pratique depuis plus longtemps : moduler l'effort de raisonnement à l'intérieur d'un modèle unique, dans un rapport pouvant aller de un à huit selon IT Social, sans modifier le tarif affiché. Pour un revendeur qui construisait son offre sur la différenciation entre les variantes Sol, Terra et Luna, ce changement impose une révision complète du positionnement commercial.
Les chiffres de GitLab : seul repère disponible
Parmi les trois acteurs qui distribuent Astra, GitLab est le seul à avoir publié des mesures d'usage concrètes plutôt que des scores de capacité abstraits. Sur une exécution courante de sa plateforme d'agents, l'éditeur relève 43,4 % de temps en moins par rapport à GPT-5.6 Sol, 49,2 % sur les exécutions les plus lentes, et 42,7 % de jetons consommés en moins par exécution. Ces données portent sur des tâches de développement logiciel et proviennent d'un acteur qui a un intérêt commercial à valoriser sa plateforme. Elles restent néanmoins le seul ordre de grandeur disponible pour poser le calcul économique.
GitLab ajoute une réserve que ni OpenAI ni Microsoft ne formulent explicitement : le modèle achève l'intégralité des tâches soumises et en résout 63,3 %, il excelle sur les mises à jour de dépendances et les corrections de compilation, mais l'éditeur recommande de conserver GPT-5.6 Sol pour les modifications exigeant le maximum de précision. Un distributeur qui oriente les travaux sensibles vers la génération précédente donne une indication précieuse sur le positionnement réel du modèle.
La grille Microsoft complique la lecture du tarif
Microsoft a ouvert la disponibilité générale d'Astra le 3 septembre, six jours avant qu'OpenAI ne publie sa propre page produit. La grille tarifaire de Microsoft est plus détaillée que celle d'OpenAI et modifie sensiblement la lecture du coût réel.
Les dix dollars en entrée et cinquante en sortie ne s'appliquent qu'aux contextes courts. Au-delà, l'entrée monte à vingt dollars et la sortie à soixante-quinze, ce qui rétablit sur les charges à fort contexte une partie de l'écart que la sobriété du modèle avait comblé. La lecture de cache descend à un dollar le million de jetons, mais l'écriture en cache se facture 12,50 dollars, au-dessus du tarif d'entrée lui-même. Une organisation qui relit fréquemment le même contexte y gagne, celle qui en produit sans cesse de nouveaux y perd.
Sur la question de la localisation des données, aucune zone européenne ne figure dans la grille publiée par Microsoft. Les organisations françaises qui souhaitent cantonner leurs traitements sur un territoire nommé doivent choisir entre une zone globale sans engagement de localisation et une zone de données américaine facturée 10 % de plus. Cette contrainte est directement pertinente pour tout revendeur qui accompagne des clients soumis au RGPD ou à des exigences sectorielles de souveraineté. La CNIL rappelle régulièrement que le transfert de données hors de l'Espace économique européen doit faire l'objet de garanties appropriées.
Tableau de synthèse : ce qui change avec GPT-6 Astra
| Ce qui change | Pour qui | Échéance | Ce que vous devez faire |
|---|---|---|---|
| Tarif d'entrée doublé à 10 $/million de jetons (contextes courts) | Tout intégrateur facturant à la consommation API | Immédiat, disponibilité générale depuis le 3 septembre | Recalculer les marges sur les contrats existants basés sur GPT-5.6 Sol |
| Suppression des trois variantes Sol, Terra, Luna | Revendeurs ayant construit une offre différenciée sur ces paliers | Immédiat | Réviser la grille tarifaire client et le discours commercial |
| Tarif d'entrée à 20 $/million de jetons pour les contextes longs | Intégrateurs traitant des documents volumineux ou des historiques étendus | Immédiat | Identifier les cas d'usage à fort contexte et simuler l'impact sur la facture |
| Absence de zone de données européenne chez Microsoft | Revendeurs accompagnant des clients soumis au RGPD ou à des contraintes sectorielles | Immédiat | Documenter le risque de localisation et proposer des alternatives souveraines si nécessaire |
| Consommation de jetons en recul de 42,7 % mesurée par GitLab sur des tâches de développement | Intégrateurs de plateformes d'agents et de DevOps IA | À mesurer sur vos propres charges | Rejouer une semaine de travail existante sur les deux générations pour établir votre propre solde |
Ce que ça change pour vous
- Recalculez vos marges avant de migrer. Le tarif d'entrée double, mais la consommation de jetons recule selon les premiers retours d'intégrateurs. Sans mesure sur vos propres charges, vous ne pouvez pas savoir si la migration vers Astra améliore ou dégrade votre équation économique. Rejouer une semaine de production réelle sur les deux modèles est la seule méthode fiable.
- Révisez vos contrats à la consommation. Si vous facturez vos clients sur la base d'un coût au jeton ou d'un forfait indexé sur l'usage API, la grille tarifaire d'Astra modifie vos hypothèses de base. Les charges à fort contexte sont particulièrement exposées, avec un tarif d'entrée qui peut atteindre vingt dollars le million de jetons chez Microsoft.
- Anticipez la question de la localisation des données. L'absence de zone européenne dans la grille Microsoft est un argument que vos clients les plus sensibles sur la souveraineté soulèveront. Préparez une réponse documentée et, si nécessaire, une alternative. Les revendeurs qui accompagnent des collectivités, des établissements de santé ou des acteurs financiers sont particulièrement concernés.
- Ne retirez pas GPT-5.6 Sol de votre catalogue trop vite. GitLab lui-même recommande de conserver la génération précédente pour les tâches exigeant le maximum de précision. Proposer les deux modèles en parallèle vous permet de positionner Astra sur le volume et Sol sur la précision, tant que vous n'avez pas de données propres pour affiner ce découpage.
- Documentez la répartition lecture/écriture de cache. L'écriture en cache est facturée 12,50 dollars le million de jetons chez Microsoft, au-dessus du tarif d'entrée standard. Pour les architectures qui génèrent en permanence de nouveaux contextes, le cache peut devenir un poste de coût inattendu plutôt qu'une source d'économie.
À surveiller
Le solde financier réel entre la hausse du tarif affiché et la baisse de consommation de jetons reste indéterminé à ce stade. Aucun des trois distributeurs d'Astra ne publie ce calcul consolidé. GitLab fournit des chiffres d'usage, mais sur un périmètre limité aux tâches de développement. OpenAI et Microsoft communiquent sur les capacités du modèle, pas sur son coût effectif par tâche métier.
La disponibilité simultanée de GPT-5.6 Sol et de GPT-6 Astra rend possible une comparaison directe sur des charges réelles. C'est la méthode que les intégrateurs sérieux devront mettre en place avant de basculer leurs clients. Par ailleurs, l'absence de zone de données européenne chez Microsoft est une situation susceptible d'évoluer, mais aucune annonce n'a été faite à ce jour. Enfin, la stratégie d'OpenAI de revenir à un modèle unique après avoir expérimenté la segmentation en trois paliers montre que les grilles tarifaires de l'IA générative restent instables. Toute offre commerciale construite sur une hypothèse de coût fixe doit intégrer une clause de révision.
Pour les revendeurs qui distribuent des solutions de productivité ou d'automatisation basées sur les API OpenAI, le suivi de la page de tarification officielle d'OpenAI et de la grille Azure AI de Microsoft est désormais un exercice mensuel, pas trimestriel. Les comparatifs disponibles sur grossiste-informatique.fr peuvent également vous aider à identifier les partenaires distributeurs les mieux positionnés pour accompagner vos projets d'infrastructure IA.
Questions fréquentes
Comment savoir si GPT-6 Astra coûte réellement plus cher que GPT-5.6 Sol pour mes clients ?
La seule méthode fiable consiste à rejouer un volume représentatif de tâches réelles sur les deux modèles en parallèle, en mesurant le nombre de jetons consommés à chaque étape. Le tarif d'entrée double, mais la consommation de jetons peut reculer de façon significative selon la nature des tâches, comme le montrent les mesures publiées par GitLab sur ses propres charges de développement. Sans cette mesure sur vos propres cas d'usage, vous ne pouvez pas conclure dans un sens ou dans l'autre. La disponibilité simultanée des deux générations de modèles rend cet exercice possible dès maintenant.
Mes clients français peuvent-ils utiliser GPT-6 Astra en respectant leurs obligations RGPD ?
La question mérite d'être posée avec précision. À ce stade, Microsoft ne propose Astra que sur une zone globale et une zone de données américaine, cette dernière facturée 10 % de plus. Aucune zone de données européenne n'est disponible dans la grille publiée. Pour les clients soumis à des exigences strictes de localisation des données, notamment dans les secteurs de la santé, des finances ou des collectivités territoriales, cette absence constitue un obstacle réel. Il convient de documenter ce point dans vos analyses de risque et d'explorer les alternatives disponibles, qu'il s'agisse de modèles hébergés sur des infrastructures souveraines ou de solutions concurrentes disposant d'une implantation européenne certifiée.
Si vous souhaitez identifier les grossistes et distributeurs les mieux positionnés pour vous accompagner dans la mise en place d'une infrastructure adaptée à vos projets IA, le formulaire de mise en relation gratuit de grossiste-informatique.fr vous permet d'entrer en contact avec les acteurs pertinents selon votre profil et vos besoins.