Come funziona questa calcolatrice
IL Calcolatore dei prezzi LLM misti calcola il costo reale di una singola chiamata API e il tariffa effettiva per token da 1 milione che risulta dalla combinazione di token di input e output. Inserisci quattro valori: quelli del modello prezzo di input per 1 milione di token, suo prezzo di uscita per 1 milione di token, e il token di input e output utilizzati per chiamata. Lo strumento moltiplica ogni conteggio di token per il suo tasso di corrispondenza e somma i due insieme, quindi il costo per chiamata è determinato sia dai prezzi pubblicati che dal tuo mix di token effettivo. Poiché i token di output di solito costano molte volte di più dei token di input, una chiamata che richiede molto testo generato può costare molto di più di quanto suggerisca la sola lunghezza di input.
La tariffa mista è importante perché un unico prezzo adesivo nasconde ciò che pagherai effettivamente. Un modello con input economici ma output costosi può rivelarsi più costoso di un rivale una volta acquistato rapporto simbolico reale viene applicato. Il consiglio pratico: abbina i conteggi dei token a una chiamata rappresentativa piuttosto che al caso migliore, quindi confronta i modelli su tariffa mista per 1 milione invece del prezzo di input principale. Osserva attentamente il lato dell'output: tagliare le risposte dettagliate o limitare la lunghezza dell'output spesso riduce i costi più che ridurre il prompt.
Domande frequenti
Perché l’output è più costoso dell’input?
La generazione di token richiede un’elaborazione più intensiva rispetto alla loro lettura, quindi i fornitori valutano l’output circa 3-5 volte più alto dell’input. Un prompt con un contesto vasto ma una risposta breve può ancora essere dominato dai pochi token di output costosi o viceversa, a seconda del mix di token.
Qual è il prezzo del token misto?
Il tuo vero tasso effettivo una volta che l'input e l'output sono ponderati in base al numero di ciascuno effettivamente utilizzato. I prezzi pubblicizzati sono frazionati; la tariffa mista ti dice quanto costa una chiamata reale per token, che è ciò che dovresti utilizzare per il margine e la previsione.