tu motor / mes
por hora
por minuto
más barato / mes

Motores de transcripción OpenAI clasificados según su volumen

Mismo audio, más barato primero.

Motor$/minutoTu $/mes
⚠️Estimación. Los precios por minuto son cifras de referencia (julio de 2026) y pueden cambiar; confírmelo en Página de precios de OpenAI. El audio se factura por duración, no por tamaño de archivo. Los modelos de transcripción gpt-4o también se pueden medir mediante tokens de audio en algunos niveles; Las cifras por minuto aquí son estimaciones de lista documentadas. · Informar precio desactualizado →

Cómo funcionan los precios de Whisper API

La API Whisper de OpenAI cobra un piso $0,006 por minuto de audio (alrededor de 0,36 dólares la hora) y facturas por duración, no el tamaño del archivo ni el recuento de palabras. El uso se redondea al segundo más cercano, por lo que un clip de 90 segundos cuesta aproximadamente un centavo independientemente de cuántas palabras contenga; una grabación mayoritariamente silenciosa cuesta lo mismo que una rápida, con gran densidad de voz y de igual duración. Para planificar el gasto, tome su audio mensual en minutos, multiplíquelo por la tarifa por minuto y tendrá la factura. el mas nuevo gpt-4o-transcribir se sitúa en un precio similar de ~$0,006/min, mientras que gpt-4o-mini-transcribir viene alrededor 0,003$/minuto (aproximadamente la mitad), lo que la convierte en la opción más económica para trabajos de lotes grandes en los que no se necesita el modelo más grande.

Whisper vs gpt-4o-transcribir

Debido a que Whisper y gpt-4o-transcribe cuestan aproximadamente lo mismo por minuto, la decisión depende principalmente de precisión versus precio, no presupuesto. gpt-4o-transcribe generalmente maneja mejor el audio ruidoso, los acentos y el vocabulario de dominio; El clásico Whisper (whisper-1) es un caballo de batalla probado y bien comprendido. Si está transcribiendo miles de horas limpias y claras al mes y quiere reducir la factura, gpt-4o-mini-transcribe a ~$0,003/min reduce a la mitad el costo por una modesta compensación de precisión. Pruebe los tres en una muestra representativa de su propio audio antes de comprometerse: la tasa de error de palabra en su contenido real importa mucho más que una fracción de centavo por minuto.

Whisper de autohospedaje frente a la API

Whisper, de código abierto, elimina la tarifa por minuto pero agrega alquiler de GPU, operaciones y tiempo de inactividad. Por debajo de unos pocos cientos de horas al mes, la API alojada casi siempre gana tanto en precio como en simplicidad; por encima de eso, una GPU que se ejecuta cerca del reloj puede superarlo. Si sus transcripciones luego alimentan un LLM (resúmenes, preguntas y respuestas sobre llamadas, búsqueda), agregue ese costo simbólico en el Calculadora de costos de tokens LLMy compare proveedores completos de conversión de voz a texto en el calculadora de costos de transcripción y calculadora de costos de voz a texto.

Preguntas frecuentes

¿Cuánto cuesta la API de Whisper?

La API Whisper de OpenAI cuesta 0,006 dólares por minuto de audio (aproximadamente 0,36 dólares por hora) y se factura por duración y se redondea al segundo más cercano. Una grabación de una hora cuesta lo mismo ya sea con mucho discurso o silencio, porque pagas por la duración, no por las palabras o el tamaño del archivo. Los precios son estimaciones de referencia; confirme la tarifa actual en la página de precios de OpenAI.

Whisper vs gpt-4o-transcribe: ¿cuál es más barato?

Whisper y gpt-4o-transcribe cuestan alrededor de $0,006 por minuto, por lo que cuestan aproximadamente lo mismo. El gpt-4o-mini-transcribe más nuevo cuesta aproximadamente la mitad (~$0,003/min) y es el más barato para trabajos por lotes de gran volumen donde no se necesita el modelo más grande. gpt-4o-transcribe generalmente ofrece una mayor precisión en audio ruidoso o acentuado, por lo que es precisión frente a una tasa más baja, no una gran diferencia de precio.

¿Whisper es un alojamiento propio más barato?

Whisper, de código abierto, elimina la tarifa por minuto, pero usted paga por la GPU, las operaciones y el tiempo de inactividad. Por debajo de unos cientos de horas al mes, la API alojada casi siempre es más barata y sencilla; por encima de eso, una GPU bien utilizada que se ejecute cerca del reloj puede ganar. El cruce depende de la utilización: una tarjeta que transcribe las 24 horas del día, los 7 días de la semana se amortiza bien, una que se usa unas pocas horas al día no.

Herramientas y guías relacionadas

Calculadora de costos de transcripción · Calculadora de costos de voz a texto · Calculadora de costos de tokens LLM · Aprender · Todas las API de IA

Aloja tu proyecto:Océano Digital — $200 gratis ↗VPS Hostinger
Costo de transcripciónCosto de voz a textoCosto de texto a vozCosto del token LLM