incrustación de corpus de una sola vez
consultas incrustadas / mes
reintegración / año
total año 1

Costo único del corpus por proveedor

Mismo corpus, cada modelo de incrustación ocupó el primer lugar como el más barato.

Modelo$/1 millón de tokensSe atenúaCosto del cuerpo
⚠️Estimación. Los precios y las dimensiones de inserción por token son cifras de referencia (junio de 2026) y cambian: consulte la página del proveedor. Vector almacenamiento y consulta en una base de datos de vectores están separados y, por lo general, son la factura en curso más grande; tamaño que en el calculadora de costos de bases de datos vectoriales. · Informar precio desactualizado →

Incrustar el corpus es la parte barata

El primer instinto es temer el costo de incorporar una gran base de conocimientos. Relájese: los modelos de empotrar modernos son extraordinariamente barato por token – a menudo de dos a trece centavos por millón de tokens. Incrustar 100.000 fragmentos de 500 tokens son 50 millones de tokens, lo que se sitúa en algún punto entre $1 y $7 como un costo único en la mayoría de los proveedores. Para los corpus típicos, la inserción única es un error de redondeo. Los costos que realmente se acumulan residen en otra parte, y es fácil pasarlos por alto al realizar una estimación.

Los dos costos que la gente olvida

Primero, cada consulta también se integra. Un producto de búsqueda que incorpora 500.000 consultas al mes paga una pequeña tarifa recurrente que, a lo largo de un año, puede superar discretamente el coste único del corpus. Segundo, cambiar su modelo de incrustación o fragmentar vuelve a incrustar todo — cambie de un modelo pequeño a uno grande, o vuelva a fragmentarlo para una mejor recuperación, y pagará nuevamente el costo total del corpus. Los equipos que iteran sobre la calidad de la recuperación se vuelven a integrar varias veces antes de estar satisfechos. Establezca sus reinserciones esperadas por año arriba para ver cuánto cuesta realmente esa iteración.

El almacenamiento es la factura que nunca se detiene

Las incrustaciones son vectores, y almacenar millones de ellos en una base de datos de vectores administrada (Pinecone, Qdrant Cloud, Weaviate) suele ser la solución. línea en curso más grande, eclipsando la propia API de incorporación. Los modelos de dimensiones más altas (1536, 3072) cuestan más para almacenar y buscar que los compactos, por lo que el modelo de integración más barato por token no es automáticamente el sistema más barato. Precio del lado de almacenamiento y consulta en el calculadora de costos de bases de datos vectoriales, luego junte toda la tubería en el Calculadora de costos RAG.

Herramientas y guías relacionadas

Calculadora de costos de bases de datos vectoriales · Calculadora de costos RAG · Calculadora de costes de ajuste · Calculadora de costos de tokens LLM · Todas las API de IA

Aloja tu proyecto:Océano Digital — $200 gratis ↗VPS Hostinger
Costo de migración del modeloPlanificador de presupuesto APICosto de la ventana de contextoCosto del chatbot RAGRelación precio-rendimiento de IA