Счет векторной БД исходит из трех чисел, а не из модели. Сколько векторов вы храните, насколько широк каждый из них (его размерность) и сколько запросов вы выполняете. Все, что ниже, получено из этих трех — хранилище vectors × dimension × 4 bytes плюс накладные расходы на индекс, а стоимость запроса зависит от объема чтения.
Ежемесячная стоимость по поставщику
Та же рабочая нагрузка, на первом месте самый дешевый вариант. Оценка хранилища + запросов до уровня бесплатного пользования.
| Поставщик | Модель | Стандартное восточное время. / мес. |
|---|
Как строится номер хранилища
Каждый вектор представляет собой массив 32-битных чисел с плавающей запятой, поэтому одно встраивание размером 1536 измерений составляет около 6 КБ необработанный (1536 × 4 байта). Умножьте на количество векторов для необработанной полезной нагрузки, затем примерно прибавьте 50% накладные расходы для структуры индекса HNSW/IVF и метаданных, которые каждое серьезное векторное хранилище хранит вместе с необработанными векторами. Это цифра «индексированного хранилища» выше — то, за что взимает плату каждый провайдер, независимо от того, называет ли он это хранилищем, модулем или размером кластера. Удвоение размера (1536 → 3072) удваивает это число для того же количества векторов, поэтому принцип «большее встраивание = лучше» не является свободным выбором.
Почему у поставщиков такие разные цены
Сосновая шишка и Зиллиз Клауд являются бессерверными на основе использования: вы платите за сохраненные ГБ плюс единицы чтения и записи, поэтому конечная точка RAG с большим объемом чтения может стоить дороже, чем предполагает ее хранилище. Кдрант Облако и Плетёное облако они ближе к вычислительным/оперативным ресурсам — вы выбираете размер кластера, который должен хранить индекс в памяти, поэтому стоимость учитывает хранилище больше, чем запросы. pgvector это всего лишь расширение внутри Postgres: если у вас уже есть база данных, добавление векторов происходит почти бесплатно, пока индекс не перерастет оперативную память, после чего вы платите за более крупный блок. Калькулятор объединяет все эти данные в одну форму хранилища + запроса, чтобы вы могли сравнить порядок величины, а затем подтвердить точный счет у выбранного вами поставщика.
Как снизить счет
Храните меньше частей, но лучше, чем каждый абзац дважды. Используйте меньший размер встраивания, когда позволяет отзыв — 768-d часто соответствует 1536-d в узких доменах с половиной меньшего объема хранилища. Отбросьте устаревшие векторы вместо того, чтобы позволить индексу расти вечно. И помните о стороне чтения: кэширование частых запросов и контекста LLM вокруг них — вот где настоящие деньги. Соедините это с быстрый калькулятор экономии кэширования и, если вы оцениваете весь конвейер поиска, калькулятор стоимости чат-бота или полный Оценщик стоимости приложения с искусственным интеллектом.
Выбираете вложения? ОпенАИ и Близнецы в руководствах указаны текущие цены на встраивание, а также Калькулятор стоимости ИИ-агента комплексно охватывает агентов с расширенным поиском.