24 juillet 2026 · IA & LLM · 5 min de lecture
Voici la partie qui manque à la plupart des gens : sur l'API, GPT-5 est moins cher que GPT-4o. Le produit phare GPT-5 est répertorié à 1,25 $ par million de jetons d'entrée et 10 $ par 1 million de sortie — exactement la moitié du prix d'entrée de GPT-4o (2,50 $) au même prix de sortie (10 $), avec une fenêtre contextuelle de 400 000 $ au lieu de 128 000. Plus récent et moins cher n’est pas la direction habituelle, cela vaut donc la peine de faire le calcul.
Par 1 million de jetons, de la gamme OpenAI actuelle :
| Modèle | Entrée /1M | Sortie /1M | Contexte |
|---|---|---|---|
| GPT-5.5 (meilleur produit phare) | $5.00 | $30.00 | 400K |
| GPT-5 (vaisseau amiral) | $1.25 | $10.00 | 400K |
| GPT-5 mini | $0.40 | $1.60 | 400K |
| GPT-5 nano | $0.10 | $0.40 | 400K |
| GPT-4o (pour référence) | $2.50 | $10.00 | 128 Ko |
| GPT-4o mini (référence) | $0.15 | $0.60 | 128 Ko |
Répondez à un appel typique : 1 000 jetons d'entrée + 500 jetons de sortie (une courte invite avec contexte, une réponse moyenne). Le coût est (jetons d'entrée ÷ 1M × prix d'entrée) + (jetons de sortie ÷ 1M × prix de sortie):
| Modèle | Coût / appel | À 1M d'appels/mois |
|---|---|---|
| GPT-5.5 | $0.0200 | $20,000 |
| GPT-4o | $0.0075 | $7,500 |
| GPT-5 | $0.00625 | $6,250 |
| GPT-5 mini | $0.0012 | $1,200 |
| GPT-5 nano | $0.0003 | $300 |
Donc, échanger GPT-4o contre GPT-5 sur la même charge de travail revient à 17% moins cher - et vous obtenez 3 fois le contexte gratuitement. Passez à GPT-5 mini et les mêmes coûts de travail 84% de moins que GPT-4o. GPT-5 nano le porte à 300 $/mois pour un million d'appels.
Notez que les jetons de sortie dominent chaque ligne. Sur le produit phare, le prix de la sortie est 8 fois supérieur à celui de l'entrée (10 $ contre 1,25 $). Cela signifie que le moyen le moins coûteux de réduire une facture GPT-5 n'est pas de changer de modèle, mais plutôt de changer de modèle. demander des réponses plus courtes. Un modèle verbeux qui écrit 1 500 jetons de sortie là où 300 suffiraient triple tranquillement la moitié coûteuse de votre facture. Et GPT-5.5, le niveau premium à 5 $/30 $, représente 3,2 fois le coût du GPT-5 simple par appel – cela ne vaut la peine que pour les tâches qui en ont réellement besoin.
Pour la plupart du trafic de production, la réponse honnête est GPT-5 mini ou nano, passant à GPT-5 uniquement lorsque la qualité l'exige – le modèle de routage classique. Réservez GPT-5.5 pour les raisonnements les plus difficiles. Exécutez vos propres numéros avec votre nombre réel de jetons avant de vous engager :
Vous êtes nouveau dans la tarification des jetons ? Commencez par le guides gratuits sur les coûts des API.
Les prix sont les prix catalogue OpenAI tels qu'ils sont suivis dans notre catalogue de modèles (juillet 2026) et sont des estimations de référence — confirmez les tarifs actuels sur la page de tarification d'OpenAI avant de budgétiser. Les chiffres par appel sont calculés à partir de ces prix catalogue pour un appel de jeton de 1 000 entrées/500 sorties.