Quand un seul prompt peut coûter trente dollars
Dix dollars le million de jetons en entrée, cinquante en sortie. Mais avec un contexte long, la facture d’une seule requête change complètement d’échelle.

Le dernier modèle d’OpenAI, Astra, est arrivé avec une grille tarifaire qui mérite qu’on s’y arrête avant de brancher son application dessus. Non pas à cause du prix affiché, qui reste dans les usages du secteur, mais à cause de ce que ce prix devient une fois que l’on travaille sur de longs documents.
Le prix affiché
Dix dollars le million de jetons envoyés au modèle, cinquante dollars le million de jetons produits par lui. C’est environ deux fois et demie le tarif de la génération précédente de la maison. Rien de scandaleux en soi : un nouveau modèle plus gros coûte plus cher à faire tourner, et les grilles finissent généralement par baisser.
Le prix réel
L’ennui commence au-delà d’environ 272 000 jetons de contexte, seuil à partir duquel une majoration s’applique. En empilant un contexte long, le mode le plus rapide et la variante la plus haut de gamme, une requête unique peut dépasser trente dollars, et grimper bien au-delà dans les configurations les plus gourmandes. Sur un modèle qui réfléchit avant de répondre, il faut aussi se souvenir que les jetons de raisonnement sont facturés comme les autres : vous payez une réflexion que vous ne lisez jamais. (Voir fondre une réserve de crédits en cinq minutes reste une expérience formatrice ! 🙂)
Pourquoi ça compte pour vous
Parce que le chiffre que tout le monde retient, le prix au million de jetons, n’est presque jamais celui que l’on paie. Ce qui détermine la facture, c’est la longueur du contexte, le mode choisi et le nombre d’allers-retours. Une équipe qui bâtit son budget sur le tarif de la vitrine se retrouve, un mois plus tard, à expliquer un dépassement qu’elle n’avait aucun moyen d’anticiper. La bonne pratique tient en deux gestes : plafonner la taille du contexte envoyé, et mesurer le coût réel sur un échantillon avant d’ouvrir les vannes.
D’où viennent ces chiffres
D’un calcul, pas d’une facture. Les montants les plus spectaculaires correspondent au pire cas : contexte saturé, mode le plus cher, variante la plus onéreuse. Une requête ordinaire coûte une fraction de cela. Les comparaisons avec les modèles concurrents supposent en outre que l’on s’en sert de la même façon, ce qui est rarement vrai. Ajoutons que la documentation d’OpenAI reste évasive sur ses propres mécanismes de facturation au-delà d’un certain volume, si bien qu’une partie de l’estimation repose sur des hypothèses raisonnables plutôt que sur des règles publiées. Le chiffre choc est donc un plafond, à traiter comme tel.
En bref
- Astra est facturé dix dollars le million de jetons en entrée et cinquante en sortie, environ deux fois et demie la génération précédente.
- Une majoration s’applique au-delà d’environ 272 000 jetons de contexte.
- Dans le pire cas, une seule requête peut dépasser trente dollars, davantage encore en mode rapide ou en version haut de gamme.
- Les jetons de raisonnement sont facturés, même si vous ne les lisez pas.
- Ces montants sont des plafonds calculés, pas des factures moyennes.
Sources : grille tarifaire publiée par l’éditeur, Next.
Le Bien Heureux · Redaction Capibara · Lundi 7 septembre 2026