prenotato/mese
rispetto a quello su richiesta
effettivo $/1 milione
capacità utilizzata

Prezzo effettivo all'aumentare del volume

Il costo di prenotazione è fisso, quindi ogni token aggiuntivo riduce il prezzo effettivo per milione, fino a raggiungere il limite di capacità e le fatture in eccesso alla tariffa on-demand.

Volume mensileCosto a richiestaRiservato con effetto $/1 milionePiù economico

Capacità di riserva solo al di sopra del pareggio

Il throughput assegnato (PTU su Azure OpenAI, throughput assegnato su AWS Bedrock) scambia una fattura per token con una prenotazione mensile fissa di capacità dedicata. Acquista una latenza prevedibile e un costo fisso, ma fa risparmiare denaro solo una volta che il volume costante dei token supera il pareggio: il costo di prenotazione diviso per il prezzo on-demand per token. Al di sotto di questo stai pagando per le unità inattive; al di sopra di esso, il costo fisso si distribuisce su più token e il prezzo effettivo per milione continua a diminuire, fino al limite massimo di capacità di unità × token al minuto × minuti nel mese. Superare il massimale e le bollette in eccesso a pieno tasso su richiesta, erodendo silenziosamente lo sconto. Dimensiona la prenotazione in base al volume che sei sicuro utilizzerai ogni mese e prevedi la crescita sul volume Calcolatore della previsione dei costi APIe confrontare un impegno di spesa su calcolatore dello sconto sulla spesa impegnata.

Ospita il tuo progetto:DigitalOcean: $ 200 gratis ↗Hostinger VPS
Calcolatore dei costi di valutazione LLMCalcolatore dei costi di generazione dei dati sinteticiLicenza AI Seat e calcolatore dei costi APICalcolatore dei tempi e dei costi di elaborazione batchCalcolatore del costo AI per utente