Calculadora de custos indiretos de token multilíngue
✓ Última verificação: 29/07/2026· Proporções: tokenizer classe o200k, aproximado· relatar um problema →
Tokenizadores LLM são Otimizado para inglês, então a mesma mensagem custa muito mais tokens em Japonês, árabe, hindi ou russo - muitas vezes 1,5× a 3× mais. Isso precifica o multiplicador de tokens para cada idioma, o extra custo mensal de atender usuários que não falam inglês e uma mesa lado a lado em 20 idiomas portanto, o verdadeiro prêmio de uma base global de usuários é óbvio.
O multiplicador dimensiona os tokens de entrada e saída.
—
este idioma / mo
—Inglês / mês
—extra / mês
—prêmio
Custo por idioma no seu volume
O mesmo produto, os mesmos tokens, com preços em cada idioma. As línguas de escrita latina têm um preço leve; scripts não-latinos custam muito mais. O idioma selecionado está marcado; os multiplicadores são aproximados para um tokenizer de classe o200k – substituído por um valor medido para precisão.
Linguagem
Multiplicador
Custo mensal
Extra vs Inglês
Uma base global de usuários não é uma taxa fixa
A maneira mais limpa de estourar um orçamento de lançamento é precificar um produto em tokens ingleses e depois abri-lo para o mundo. Os modelos faturam por token, os tokens são o que o tokenizer extrai do texto, e o tokenizer aprendeu seus pedaços mais eficientes do inglês – portanto, a mesma frase, traduzida, significa mais tokens, e mais tokens significa mais dinheiro. Para as línguas de escrita latina o imposto é moderado; um utilizador espanhol ou alemão custa talvez um quinto mais do que um utilizador inglês. Mas no momento em que você fornece um script diferente, o número salta: o cirílico quase dobra, o japonês e o coreano ficam bem acima de um e meio, e o árabe, o hindi e o tailandês podem chegar a três vezes o inglês para conteúdo idêntico - e como os tokens de saída custam várias vezes mais do que os tokens de entrada, o prêmio é mais difícil na resposta do modelo, a metade cara da conta. Nenhum dos truques usuais de economia ajuda aqui: cortar o prompt ou armazenar em cache um preâmbulo compartilhado reduz a sobrecarga do inglês, e não o idioma da resposta. O que ajuda é saber o número antes de se comprometer – quais idiomas você está subsidiando, por quanto, e se um pipeline mais barato em inglês envolvido em tradução prejudicaria a execução nativa do modelo. Defina o preço de uma única solicitação primeiro com o calculadora de custo de token, conte tokens para uma string específica com o contador de tokens, e se a solução for mudar para um modelo com um tokenizer mais amigável, compare as taxas efetivas no página de comparação de modelos.
Ele começa com a contagem de tokens para uma solicitação em inglês – entrada e saída separadamente – e os preços por milhão de cada um. O custo por solicitação em inglês é o token de entrada vezes o preço de entrada mais os tokens de saída vezes o preço de saída, dividido por um milhão; o custo mensal é o multiplicado pelas solicitações por mês. Para outro idioma, ele multiplica ambas as contagens de tokens pelo multiplicador de idioma, uma proporção que captura quanto mais o mesmo conteúdo é tokenizado naquele idioma e, em seguida, reprecifica. O custo extra é a diferença e a porcentagem do prêmio é simplesmente o multiplicador menos um. A tabela por idioma aplica o multiplicador de cada idioma ao seu próprio volume para que você possa compará-los diretamente. Os multiplicadores são médias aproximadas para um tokenizer de classe o200k e variam de acordo com o texto e modelo exatos, portanto, trate-os como números de planejamento e substitua o campo por uma proporção medida – conte a mesma passagem em inglês e no idioma de destino com um contador de token – quando precisar de precisão.
Perguntas frequentes
Por que o texto que não está em inglês custa mais tokens?
O tokenizer foi treinado principalmente em inglês, por isso aprendeu pedaços longos e eficientes para inglês e pedaços mais curtos e numerosos para todo o resto. Escritas não latinas, como árabe, hindi e japonês, costumam ser divididas caractere por caractere, com alguns caracteres custando mais de um token. O mesmo significado, mais tokens, contas mais altas – e os tokenizadores modernos estreitam a lacuna, mas não a fecham.
Quanto custa cada idioma a mais?
Os idiomas de escrita latina (espanhol, francês, alemão) funcionam cerca de 1,2–1,3× o inglês. O cirílico fica perto de 1,9×, o chinês em torno de 1,4–1,5×, o japonês e o coreano em 1,6–1,8× e o árabe, hindi, bengali e tailandês de 2× a quase 3×. Eles são aproximados e dependem do tokenizador, portanto a calculadora permite substituir o multiplicador por um valor medido.
A sobrecarga se aplica tanto à saída quanto à entrada?
Sim. Quando o modelo responde no idioma do usuário, sua saída é tokenizada com a mesma ineficiência e, como a produção geralmente tem um preço várias vezes mais alto do que a entrada, o prêmio é mais difícil. Esta calculadora dimensiona as contagens de tokens de entrada e saída pelo multiplicador e os precifica em suas taxas separadas.
Como posso reduzir o prêmio do token multilíngue?
Mude para um modelo com um tokenizer mais multilíngue, envolva um pipeline barato apenas em inglês na tradução para idiomas de baixo volume e multiplicadores pesados, ou simplesmente defina o preço e o orçamento regionalmente, agora que você sabe o número. O corte de prompt e o cache de prefixo não ajudam, porque o custo está no idioma da resposta, não no preâmbulo.