HomeAI APIs › Coût du substratum AWS
coût mensuel estimé
coût par demande
part d'entrée / mois
part de production / mois

Chaque modèle Bedrock pour cette charge de travail

Mêmes jetons et même volume, prix dans tout le catalogue – classés en premier lieu les moins chers.

ModèleEntrée/Sortie (par 1M)Par demandeMensuel
⚠️ Estimation de référence. Les prix du substrat rocheux varient selon la région et changent au fil du temps — confirmez les tarifs actuels sur le Page de tarification d'AWS Bedrock. Les remises par lots et par mise en cache rapide sont approximatives et dépendent du modèle. Le débit provisionné (fixé toutes les heures) ne peut dépasser la demande qu'à un volume élevé et constant. · Signaler un prix obsolète →

Comment fonctionne réellement la facturation Bedrock

Amazon Bedrock est une passerelle, pas un modèle unique. Vous appelez Claude, la propre famille Nova d'Amazon, Meta's Llama, Mistral ou Titan via une seule API, et chacun est mesuré de la même manière : un taux par million. saisir des jetons (tout ce que vous envoyez : invite du système, contexte, message de l'utilisateur) et un taux distinct, généralement plus élevé, par million sortir jetons (ce que le modèle génère). Il n'y a pas de minimum mensuel sur demande ; votre facture est purement symbolique × tarif. La subtilité que la plupart des estimations oublient est que la production est l'endroit où va l'argent - son prix est deux à cinq fois plus élevé que celui de l'entrée sur les niveaux Claude et Nova, donc un modèle bavard qui écrit de longues réponses coûte beaucoup plus cher que son taux d'entrée ne le suggère.

Cette calculatrice rend cela visible. Entrez les jetons qu'une requête typique envoie et reçoit, ainsi que le nombre de requêtes mensuelles, et il divise la facture en un partage d'entrée et un partage de sortie afin que vous puissiez voir lequel attaquer. Ensuite, cela coûte le même charge de travail dans l'ensemble du catalogue Bedrock et les classe, car le modèle le moins cher pour un synthétiseur qui lit beaucoup et écrit un peu n'est pas le modèle le moins cher pour un générateur qui écrit de longues sorties. Le titre « par million » vous indique rarement le gagnant – votre combinaison de jetons le fait.

Les trois leviers qui réduisent la facture de Bedrock

1. Choix du modèle. Passer d'une frontière Claude à Nova Lite ou Llama pour les demandes qui ne nécessitent pas de raisonnement approfondi peut réduire les coûts de plus de 90 % — le tableau montre exactement combien pour votre mix. Acheminez les invites difficiles vers le grand modèle et les plus faciles vers un modèle bon marché ; dimensionner la division avec le calculateur de routage modèle. 2. Inférence par lots. Si le travail ne s'effectue pas en temps réel (enrichissement nocturne, classification en masse, évaluations), le mode batch de Bedrock l'exécute à environ la moitié du prix. Retournez le mode de tarification ci-dessus pour le voir. 3. Mise en cache rapide. Lorsque de nombreuses requêtes partagent un grand préfixe fixe (une longue invite système, un document, quelques exemples), la mise en cache de cette entrée la réduit jusqu'à 90 % ; définissez le pourcentage d'entrée en cache pour modéliser l'économie et creusez plus profondément avec le calculateur de mise en cache rapide.

Bedrock vs l'API directe

Pour le même modèle Claude, les prix catalogue par jeton sur Bedrock et le API anthropique directe sont généralement identiques ou à l’intérieur d’une erreur d’arrondi. Le choix est donc opérationnel et non financier : choisissez Bedrock pour conserver l'inférence dans votre compte AWS, IAM et VPC, pour consolider la facturation et pour atteindre Nova, Llama, Mistral et Titan via une seule intégration. Choisissez l'API directe pour les modèles les plus récents dès le premier jour et la configuration la plus simple. Si le coût est toute la question, comparez le gagnant ici avec le API LLM la moins chère entre les fournisseurs avant de vous engager.

Comment l'utiliser

1. Choisissez un modèle et entrez votre volume de demande mensuel.
2. Saisissez les jetons d'entrée et de sortie typiques par requête (une moyenne approximative suffit).
3. Choisissez à la demande ou par lots et définissez la part d'entrée pouvant être mise en cache.
4. Lisez le coût mensuel et le coût par demande, puis parcourez le tableau pour voir si un modèle moins cher couvre le même travail.

Erreurs courantes

Estimation sur les jetons d'entrée uniquement. La sortie représente la moitié la plus chère – incluez toujours une longueur de sortie réaliste. Utiliser des moyennes qui masquent les longues réponses. Si certaines réponses sont 5 fois plus longues, votre facture réelle est supérieure à la moyenne ; modélisez également le pire des cas. Oublier les leviers libres. Les lots et la mise en cache sont des économies définies une seule fois que de nombreuses équipes n'activent jamais. Ignorer les coûts environnants. Les engagements en matière de transfert de données, de stockage pour RAG et de débit provisionné se situent en dehors de la tarification par jeton : budgétisez-les séparément.

FAQ

Bedrock facture-t-il des frais de base ou mensuels ?

Non, Bedrock à la demande est un pur paiement par jeton sans minimum. Vous ne payez qu'un montant fixe si vous choisissez Provisioned Throughput, qui réserve de la capacité à l'heure pour des charges de travail élevées et constantes.

Quel est le modèle Bedrock le moins cher ?

Nova Micro et Nova Lite d'Amazon sont les moins chers pour le texte, à une fraction de cent pour mille jetons. Llama 3.3 70B a une forte valeur intermédiaire et Claude Haiku est le Claude le moins cher. Le tableau les classe en fonction de votre combinaison exacte de jetons.

Combien les lots permettent-ils d'économiser sur Bedrock ?

Environ 50 % par rapport à la demande pour les emplois qui ne nécessitent pas de réponse immédiate. Basculez le mode de tarification sur batch pour voir la différence sur votre charge de travail.

Puis-je mélanger les modèles pour économiser de l'argent ?

Oui, le routage des requêtes faciles vers un modèle bon marché et des requêtes difficiles vers un modèle frontière est le plus grand levier après avoir choisi la bonne valeur par défaut. Estimez le coût global avec le calculateur d'économies de routage du modèle.

Estimation seulement. Les prix du substrat rocheux diffèrent selon la région et changent : vérifiez les tarifs actuels auprès d'AWS avant de budgétiser.

Hébergez votre projet :DigitalOcean — 200 $ gratuits ↗VPS Hostinger
Suivi des dépenses IARecherche d'alternatives à l'APIAffinement vs invitePrévision des coûts des APICalculateur de coûts de réglage fin