Fournisseur
Catégorie

0 modèles comparés · cliquez sur un en-tête de colonne pour trier

Modèle ▲▼ Fournisseur ▲▼ Saisir $/1M ▲▼ Sortir $/1M ▲▼ Mélangé 3:1 ▲▼ Contexte ▲▼ Ton $/mois ▲▼
⚠️ Les prix sont des chiffres de référence approximatifs, dernière mise à jour 2026-07, et changez fréquemment — €/£ affiché à un taux de change fixe approximatif pour une comparaison rapide ; confirmez toujours sur la page de tarification du fournisseur avant de vous engager. Les jetons de sortie coûtent plus cher que les entrées sur presque tous les fournisseurs. Les modèles hébergés à poids ouvert (Llama, Qwen, DeepSeek, Mixtral) varient selon l'hôte. Prix ​​le moins cher ≠ meilleure qualité ; évaluez le coût par rapport à la précision de votre tâche.

Pourquoi une comparaison équitable des prix de l'IA nécessite deux chiffres

Presque tous les tableaux de « tarification des modèles d’IA » que vous trouverez en ligne sont triés par prix d’entrée, car il s’agit du nombre le plus petit et le plus convivial à imprimer. Mais les applications réelles sont facturées les deux directions, et les jetons de sortie ont généralement un prix deux à six fois plus élevé que celui des entrées. Une application de récupération ou de synthèse qui lit de longs documents et rédige des réponses courtes nécessite beaucoup de saisies ; un chatbot, un agent ou un générateur de code qui produit de longues complétions est gourmand en résultats. Les deux mêmes modèles peuvent échanger leurs places dans le classement uniquement en fonction de l'orientation de votre trafic. C'est pourquoi ce tableau montre les entrées et les sorties séparément, ajoute un ligne de base mélangée 3:1 (un ratio courant dans le monde réel de trois jetons d'entrée par jeton de sortie) pour un tri rapide pommes à pommes, et vous permet de saisir vos propres volumes pour calculer la facture que vous paieriez réellement.

Comment lire le tableau

Tapez dans la zone de recherche pour accéder à un modèle ou à un fournisseur, ou cliquez sur les puces du fournisseur et de la catégorie pour affiner le champ : produit phare, moyen, budget, raisonnement, intégration, vision ou poids ouvert. Cliquez sur n’importe quel en-tête de colonne pour trier par ordre croissant, cliquez à nouveau pour inverser. Le Votre $/mois La colonne recalcule instantanément à partir des volumes d'entrée et de sortie en haut, afin que vous puissiez dimensionner une charge de travail réelle pour chaque modèle à la fois. Le contexte est affiché en milliers de jetons (K) : une fenêtre contextuelle de 1 000 K signifie un million de jetons.

La qualité frontière devient bon marché

L’écart entre les modèles premium et économiques s’est considérablement réduit. En 2026, vous pourrez exécuter un modèle à poids ouvert de classe frontière – Llama 4, Qwen 3, DeepSeek V4 – pour une fraction du coût de GPT-5.5 ou Claude Opus, et pour de nombreuses tâches de production (classification, extraction, discussion de routine), la différence de qualité est invisible pour les utilisateurs finaux. Les revendeurs hébergés tels que Together, Fireworks, DeepInfra, Groq et Novita rivalisent sur les mêmes poids, le même modèle peut donc apparaître plusieurs fois à des prix légèrement différents. La bonne décision consiste rarement à « utiliser le meilleur modèle partout » ; itinéraire par difficulté, laissant un modèle bon marché gérer la majeure partie tandis qu'un modèle frontière est réservé à la minorité dure des appels.

Trois leviers en dessous du prix du modèle

Une fois que vous avez choisi un modèle, trois mécanismes réduisent encore la facture. Mise en cache rapide facture les invites système répétées et le contexte à une fraction du débit d'entrée normal - dimensionnez-le sur le calculateur d'économies de mise en cache rapide. API par lots accordez environ 50 % de réduction pour les emplois qui peuvent attendre - voir le calculateur d'économies d'API par lots. Et le routage des appels de routine vers un modèle plus petit est souvent le plus grand levier de tous : modélisez-le sur le modèle le plus petit. Calculateur de coût de routeur modèle IA.

Outils et guides associés

Outil de recherche d'API LLM le moins cher · Calculateur du coût des jetons LLM · Tarification OpenAI vs Claude vs Gemini · Calculateur de prix LLM mixte · Calculateur de coût de routeur modèle IA · Toutes les API d'IA