Calculadora de gastos generales de tokens multilingüe
✓ Última verificación: 2026-07-29· Ratios: tokenizador clase o200k, aproximado· reportar un problema →
Los tokenizadores LLM son Optimizado en inglés, por lo que el mismo mensaje cuesta muchos más tokens en Japonés, árabe, hindi o ruso - a menudo 1,5× a 3× más. Esto pone precio a la multiplicador de fichas para cada idioma, el extra costo mensual de atender a usuarios que no hablan inglés, y una mesa lado a lado frente 20 idiomas por lo que la verdadera ventaja de una base de usuarios global es obvia.
El multiplicador escala tanto los tokens de entrada como los de salida.
—
este idioma / mes
—Inglés / mes
—adicional / mes
—de primera calidad
Costo por idioma a tu volumen
El mismo producto, las mismas fichas, con precios en cada idioma. Los idiomas de escritura latina tienen una prima ligera; las escrituras no latinas cuestan mucho más. El idioma seleccionado está marcado; los multiplicadores son aproximados para un tokenizador de clase o200k; anule con un valor medido para mayor precisión.
Idioma
Multiplicador
Costo mensual
Extra versus inglés
Una base de usuarios global no es una tarifa plana
La forma más limpia de gastar un presupuesto de lanzamiento es fijar el precio de un producto en tokens ingleses y luego abrirlo al mundo. Los modelos facturan por token, los tokens son lo que el tokenizador extrae del texto, y el tokenizador aprendió sus fragmentos más eficientes del inglés, por lo que la misma oración, traducida, es más tokens, y más tokens es más dinero. Para las lenguas de escritura latina el impuesto es leve; un usuario español o alemán cuesta quizás una quinta parte más que uno inglés. Pero en el momento en que se sirve una escritura diferente, el número salta: el cirílico casi se duplica, el japonés y el coreano están muy por encima de uno y medio, y el árabe, el hindi y el tailandés pueden llegar hasta tres veces el inglés para contenido idéntico, y debido a que los tokens de salida cuestan varias veces más que los tokens de entrada, la prima afecta con más fuerza la respuesta del modelo, la mitad cara de la factura. Ninguno de los trucos de ahorro habituales ayuda aquí: recortar el mensaje o almacenar en caché un preámbulo compartido reduce la sobrecarga del inglés, no el idioma de la respuesta. Lo que ayuda es conocer el número antes de comprometerse: qué idiomas está subsidiando, en qué medida y si un canal de inglés más barato incluido en la traducción socavaría la ejecución del modelo de forma nativa. Precio de una sola solicitud primero con el calculadora de costo simbólico, cuente los tokens para una cadena específica con el contador de fichas, y si la solución es cambiar a un modelo con un tokenizador más amigable, compare las tasas efectivas en el página de comparación de modelos.
Comienza con el recuento de tokens para una solicitud en inglés (entrada y salida por separado) y los precios por millón de cada uno. El costo por solicitud en inglés es los tokens de entrada multiplicados por el precio de entrada más los tokens de salida multiplicados por el precio de salida, dividido por un millón; El costo mensual es el de las solicitudes por mes. Para otro idioma, multiplica ambos recuentos de tokens por el multiplicador de idioma, una proporción que captura cuánto más se tokeniza el mismo contenido en ese idioma y luego cambia el precio. El costo adicional es la diferencia y el porcentaje de la prima es simplemente el multiplicador menos uno. La tabla por idioma aplica el multiplicador de cada idioma a su propio volumen para que pueda compararlos directamente. Los multiplicadores son promedios aproximados para un tokenizador de clase o200k y varían según el texto y el modelo exactos, así que trátelos como cifras de planificación y anule el campo con una proporción medida (cuente el mismo pasaje en inglés y en el idioma de destino con un contador de tokens) cuando necesite precisión.
Preguntas frecuentes
¿Por qué el texto que no está en inglés cuesta más tokens?
El tokenizador fue entrenado principalmente en inglés, por lo que aprendió fragmentos largos y eficientes para inglés y otros más cortos y numerosos para todo lo demás. Las escrituras no latinas, como el árabe, el hindi y el japonés, a menudo se dividen casi carácter por carácter, y algunos caracteres cuestan más de una ficha. Mismo significado, más tokens, factura más alta, y los tokenizadores modernos reducen la brecha pero no la cierran.
¿Cuánto más cuesta cada idioma?
Los idiomas de escritura latina (español, francés, alemán) funcionan entre 1,2 y 1,3 veces el inglés. El cirílico se sitúa cerca de 1,9×, el chino entre 1,4 y 1,5×, el japonés y coreano entre 1,6 y 1,8×, y el árabe, hindi, bengalí y tailandés entre 2× y casi 3×. Estos son aproximados y dependen del tokenizador, por lo que la calculadora le permite anular el multiplicador con un valor medido.
¿Los gastos generales se aplican tanto a la producción como a la entrada?
Sí. Cuando el modelo responde en el idioma del usuario, su salida se tokeniza con la misma ineficiencia, y dado que la salida suele tener un precio varias veces mayor que la entrada, la prima es más fuerte allí. Esta calculadora escala los recuentos de tokens de entrada y salida mediante el multiplicador y les pone precio a sus tasas separadas.
¿Cómo puedo reducir la prima del token multilingüe?
Cambie a un modelo con un tokenizador más multilingüe, incluya un canal económico solo en inglés en traducción para idiomas de bajo volumen y gran multiplicador, o simplemente fije el precio y el presupuesto regionalmente ahora que conoce el número. El recorte rápido y el almacenamiento en caché de prefijos no ayudan, porque el costo está en el idioma de la respuesta, no en el preámbulo.