Счет векторной БД исходит из трех чисел, а не из модели. Сколько векторов вы храните, насколько широк каждый из них (его размерность) и сколько запросов вы выполняете. Все, что ниже, получено из этих трех — хранилище vectors × dimension × 4 bytes плюс накладные расходы на индекс, а стоимость запроса зависит от объема чтения.

индексированное хранилище
самый дешевый / месяц
самый дешевый провайдер
самый дешевый / год

Ежемесячная стоимость по поставщику

Та же рабочая нагрузка, на первом месте самый дешевый вариант. Оценка хранилища + запросов до уровня бесплатного пользования.

ПоставщикМодельСтандартное восточное время. / мес.
⚠️ Оценка по упрощенным базовым ставкам (июль 2026 г.). Модели ценообразования Vector DB сильно различаются — счета за использование Pinecone и Zilliz (хранилище + единицы чтения/записи), Qdrant и Weaviate за вычисление/ОЗУ, а pgvector — это просто Postgres на сервере, который вы запускаете. Мы объединяем каждый из них в форму хранилища ($/ГБ-месяц) + запроса ($/миллион), чтобы они были сопоставимы, что достаточно для определения бюджета, но не для расчета стоимости. Уровни бесплатного пользования (Pinecone Starter, бесплатный кластер Zilliz, Qdrant 1 ГБ бесплатно) не вычитаются. Перед оплатой подтвердите действие на странице цен каждого поставщика. · Сообщить об устаревшей цене →

Как строится номер хранилища

Каждый вектор представляет собой массив 32-битных чисел с плавающей запятой, поэтому одно встраивание размером 1536 измерений составляет около 6 КБ необработанный (1536 × 4 байта). Умножьте на количество векторов для необработанной полезной нагрузки, затем примерно прибавьте 50% накладные расходы для структуры индекса HNSW/IVF и метаданных, которые каждое серьезное векторное хранилище хранит вместе с необработанными векторами. Это цифра «индексированного хранилища» выше — то, за что взимает плату каждый провайдер, независимо от того, называет ли он это хранилищем, модулем или размером кластера. Удвоение размера (1536 → 3072) удваивает это число для того же количества векторов, поэтому принцип «большее встраивание = лучше» не является свободным выбором.

Почему у поставщиков такие разные цены

Сосновая шишка и Зиллиз Клауд являются бессерверными на основе использования: вы платите за сохраненные ГБ плюс единицы чтения и записи, поэтому конечная точка RAG с большим объемом чтения может стоить дороже, чем предполагает ее хранилище. Кдрант Облако и Плетёное облако они ближе к вычислительным/оперативным ресурсам — вы выбираете размер кластера, который должен хранить индекс в памяти, поэтому стоимость учитывает хранилище больше, чем запросы. pgvector это всего лишь расширение внутри Postgres: если у вас уже есть база данных, добавление векторов происходит почти бесплатно, пока индекс не перерастет оперативную память, после чего вы платите за более крупный блок. Калькулятор объединяет все эти данные в одну форму хранилища + запроса, чтобы вы могли сравнить порядок величины, а затем подтвердить точный счет у выбранного вами поставщика.

Как снизить счет

Храните меньше частей, но лучше, чем каждый абзац дважды. Используйте меньший размер встраивания, когда позволяет отзыв — 768-d часто соответствует 1536-d в узких доменах с половиной меньшего объема хранилища. Отбросьте устаревшие векторы вместо того, чтобы позволить индексу расти вечно. И помните о стороне чтения: кэширование частых запросов и контекста LLM вокруг них — вот где настоящие деньги. Соедините это с быстрый калькулятор экономии кэширования и, если вы оцениваете весь конвейер поиска, калькулятор стоимости чат-бота или полный Оценщик стоимости приложения с искусственным интеллектом.

Выбираете вложения? ОпенАИ и Близнецы в руководствах указаны текущие цены на встраивание, а также Калькулятор стоимости ИИ-агента комплексно охватывает агентов с расширенным поиском.

Разместите свой проект:DigitalOcean — 200 долларов бесплатно ↗Хостингер VPS
Стоимость памяти агента ИИ (Mem0 или Zep)База знаний Калькулятор стоимости повторного внедренияСтоимость LLM A/B-тестаКалькулятор стоимости токена LLMСчетчик токеновОперативная экономия на сжатии