Publié 2026-08-10 · numéros de référence, vérifier avant de budgétiser
Exécutez la même charge de travail de chaîne de pensée via o1 d’OpenAI et cela coûte 27 fois ce que coûte DeepSeek R1. Exécutez-le via o3 à la place – même fournisseur, même niveau de raisonnement, même comportement de « réflexion avant de répondre » – et l’écart tombe à 3,6 fois. Ce n'est pas une différence d'arrondi. Cela signifie que la question « combien coûte un modèle de raisonnement par rapport à un modèle à poids ouvert » n'a pas de réponse unique. Il a une réponse différente pour chaque modèle livré par OpenAI, car la propre gamme de raisonnement d'OpenAI couvre une plage de 7,5x avant même que vous ayez regardé en dehors de leur catalogue.
Tirés directement de notre tableau de prix (387 modèles suivis, dernière actualisation par rapport aux documents du fournisseur) : les quatre SKU de raisonnement actuels d'OpenAI, plus le R1 de DeepSeek et ses variantes distillées, par 1 million de jetons.
| Modèle | Fournisseur | Entrée /1M | Sortie /1M | vs DeepSeek R1 (mélangé) |
|---|---|---|---|---|
| o1 | OpenAI | $15.00 | $60.00 | 27.4× |
| o3 | OpenAI | $2.00 | $8.00 | 3.7× |
| o4-mini / o3-mini / o1-mini | OpenAI | $1.10 | $4.40 | 2.0× |
| Grok 4 Raisonnement | xAI | $3.00 | $15.00 | 6.2× |
| Recherche profonde R1 | Recherche profonde | $0.55 | $2.19 | 1.0× |
| DeepSeek R1 Distiller Lama 70B | Recherche profonde | $0.23 | $0.69 | 0.35× |
| DeepSeek R1 distillateur Qwen 32B | Recherche profonde | $0.18 | $0.18 | 0.11× |
| Prix de référence de notre tableau suivi, 387 modèles. "vs DeepSeek R1" utilise un rapport de jetons d'entrée/sortie mélangé de 3:8 correspondant à l'exemple ci-dessous. Exécutez votre propre ratio sur le calculateur de coût des jetons de raisonnement. | ||||
Remarquez la forme de cette courbe. Il ne s'agit pas d'une ligne droite entre cher et bon marché : o1 à o3 représente à lui seul une réduction de 87 % du prix de sortie dans le propre catalogue d'OpenAI, sans aucun concurrent impliqué. Les variantes distillées de DeepSeek ont ensuite sous-coté même le R1 complet de 3 à 5 fois supplémentaires, à un coût de capacité réel sur lequel les références sont honnêtes. Quatre points sur une même table, quatre histoires complètement différentes sur ce que signifie « la taxe de raisonnement ».
Un agent de support-triage qui raisonne avant de répondre : 1 500 jetons de contexte d'entrée par ticket, 4 000 jetons de sortie une fois que vous comptez les jetons de chaîne de pensée cachés facturés en sortie. 10 000 tickets par mois correspondent à 15 millions de jetons d'entrée et 40 millions de jetons de sortie, exécutés sur chaque modèle :
| Modèle | Coût des intrants | Coût de sortie | Total mensuel |
|---|---|---|---|
| o1 | $225.00 | $2,400.00 | $2,625.00 |
| Grok 4 Raisonnement | $45.00 | $600.00 | $645.00 |
| o3 | $30.00 | $320.00 | $350.00 |
| o4-mini | $16.50 | $176.00 | $192.50 |
| Recherche profonde R1 | $8.25 | $87.60 | $95.85 |
| 10 000 tickets/mois × 1 500 jetons entrants / 4 000 jetons sortants. Charge de travail illustrative : évaluez votre propre mix sur le calculateur de coût des jetons de raisonnement. | |||
2 625 $ par mois sur o1 contre 95,85 $ sur DeepSeek R1 pour une charge de travail qui, sur le papier, demande la même chose aux deux modèles. Échangez plutôt o1 contre o3 et la facture OpenAI à elle seule chute de 87 %, passant de 2 625 $ à 350 $ – avant que DeepSeek n’entre dans la comparaison. La plupart des histoires d’horreur sur la « taxe de raisonnement » qui circulent actuellement sont en fait des prix o1 reportés de l’époque où il s’agissait de la seule option de raisonnement frontalier. Ce n'est plus le cas, même au sein de la propre gamme d'OpenAI.
o1 a été tarifé alors que l'inférence raisonnée était rare et pour la plupart non prouvée - elle figurait en tête de l'ensemble du catalogue d'OpenAI, raisonnant ou non. o3 et o4-mini sont arrivés après que la concurrence (DeepSeek R1 lancée en janvier, les niveaux de raisonnement de Grok et Gemini ont suivi) a forcé les laboratoires frontaliers à défendre les prix de raisonnement de la même manière qu'ils avaient déjà été obligés de défendre les prix de chat phares. Les modèles de raisonnement de mini-niveau en particulier sont désormais suffisamment proches de la tarification de niveau intermédiaire sans raisonnement pour que « devrais-je utiliser un modèle de raisonnement » ne soit plus principalement une question de coût pour de nombreuses charges de travail ; il s'agit plutôt d'une question de latence et de chaîne de pensée-jeton-budget.
Ce qui n'a pas convergé, c'est la qualité par dollar, tout en haut. o1 et o3 ne sont pas interchangeables – o3 est le modèle le plus récent, généralement plus puissant, à une fraction du prix, ce qui constitue une mise à niveau simple. DeepSeek R1 est un compromis différent : des pondérations ouvertes, auto-hébergables et un prix similaire, mais comparé de manière significative à o3 sur des tâches de raisonnement difficiles dans la plupart des évaluations tierces que nous avons vues citées. Le nombre 27x contre o1 est réel et mérite d'être connu. Ce n'est pas la même affirmation que "R1 remplace o3 pour 27x moins" - cette comparaison est plus proche de 3,7x, et il s'agit d'un compromis de capacité, pas d'une mise à niveau gratuite.
Ne vous fixez pas sur le prix d'o1 - c'est de loin le SKU de raisonnement le plus cher du marché et de moins en moins celui par rapport auquel les équipes devraient fixer leurs prix. Ancrez-vous sur o3 ou o4-mini comme référence réaliste d'OpenAI, puis décidez si la remise 2 à 4x restante de DeepSeek R1 vaut la surcharge d'auto-hébergement ou d'inférence tierce, et si la baisse de capacité des variantes distillées est acceptable pour votre tâche. Évaluez votre combinaison réelle de jetons : les charges de travail de raisonnement faussent la production, contrairement aux charges de travail de chat, de sorte que le rapport pondéré compte plus ici que presque partout ailleurs dans la pile de coûts de l'API. Exécutez les nombres sur le calculateur de coût des jetons de raisonnement ou le calculateur de dépassement de jeton de raisonnement si les jetons de chaîne de pensée cachés sont la partie que vous ne pouvez pas prédire, et voyez la taxe sur les jetons de raisonnement pour savoir comment o3 se compare à GPT-4.1 non-raisonnement sur la même invite.
Méthodologie : prix issus de notre tableau de tarification suivi (387 modèles) en août 2026, correspondant aux tarifs publiés par 1 million de jetons de chaque fournisseur. L'exemple utilisé utilise un ratio de jetons construit de 1 500 entrées/4 000 sorties pour illustrer la mise à l'échelle, et non la télémétrie d'un système de production : confirmez la combinaison de jetons de votre propre charge de travail et le tarif actuel de chaque fournisseur avant de budgétiser.