HomeAI APIs › Стоимость ввода изображения Vision
самый дешевый / месяц
жетоны за изображение (самые дешевые)

Одно и то же изображение, каждая модель видения

То, как каждая модель токенизирует ваш имидж, и ежемесячная стоимость ввода при вашем объеме — первое место в рейтинге самых дешевых. Токены Prompt за изображение включены в ежемесячную сумму.

МодельТокены изображенийЗа изображениеПомесячно
⚠️Смета. Формулы токенизации изображений меняются в зависимости от конкретной версии модели; поставщики округляют плитки и применяют минимумы для каждого изображения. Цены являются ориентировочными значениями на 2026 год. Прежде чем составлять бюджет, подтвердите текущие ставки ввода на миллион и правила токенизации видения для вашей конкретной модели. · Сообщить об устаревшей цене →

Изображение — это замаскированные входные токены.

Когда вы отправляете изображение в модель Vision, она не считывает пиксели бесплатно — она преобразует изображение в токены и заряжает их по скорости ввода, прямо рядом с вашей текстовой подсказкой. Загвоздка в том, что каждый провайдер считает эти токены по-разному, и ни один из них не учитывает размер файла. GPT-4o OpenAI помещает изображение в сетку из 512-пиксельных плиток и взимает 85 базовых жетонов плюс 170 за плитку. Клод из Anthropic использует примерно ширину, умноженную на высоту, разделенную на 750. Gemini от Google взимает фиксированную плату в 258 токенов за маленькие изображения и размещает плитки побольше. Таким образом, один и тот же снимок экрана размером 1024×1024 может содержать 765 жетонов на одной модели и 1400 на другой — это почти двукратное колебание, прежде чем вы напишете хоть одно слово инструкции.

Это важнее всего при громкости. Конвейер обработки документов, канал модерации или функция «чат с вашими скриншотами» могут отправлять десятки тысяч изображений в день, и в этом случае токены изображений затмевают приглашение. Этот калькулятор делает компромисс видимым: он показывает, как каждая модель токенизирует ваше точное разрешение и сколько это стоит в месяц, так что вы можете выбрать самую дешевую модель машинного зрения для вашего микса изображений и мгновенно увидеть, сколько вы сэкономите за счет уменьшения масштаба. Соедините его с счетчик токенов для текстовой стороны и самый дешевый инструмент LLM API для общего выбора модели.

Как его использовать

1. Введите ширину и высоту отправляемых изображений — разрешение после любого изменения размера, которое вы уже сделали.
2. Выберите режим детализации OpenAI: высокий уровень считывает мелкий текст и небольшие метки, низкий — сглаживает до миниатюры из 85 токенов.
3. Введите количество изображений, которые вы отправляете в месяц, и, при необходимости, жетоны подсказки, которые будут сопровождать каждое из них.
4. Прочтите рейтинговую таблицу, чтобы найти самую дешевую модель машинного зрения для вашего размера изображения и ежемесячной стоимости.

Распространенные ошибки

Отправка в полном разрешении, когда подойдет кроп. Стоимость токена растет с увеличением площади пикселя, поэтому изображение размером 2048² может стоить в четыре раза больше, чем изображение размером 1024², если учесть детали, которые модели никогда не требовались. По умолчанию детализация остается высокой. Если вам нужна только суть, режим с низкой детализацией — это фиксированные 85 жетонов — часто экономия в 5–10 раз. Забывание подсказки все еще имеет значение. Токены изображения находятся поверх текстового приглашения и любого системного приглашения, поэтому реальная стоимость вызова суммируется. Игнорирование вывода. Этот инструмент оценивает изображение как входные данные; письменный ответ модели оплачивается отдельно по тарифу за результат.

Часто задаваемые вопросы

Файл большего размера стоит дороже?

Нет — стоимость токена отслеживает размеры в пикселях, а не в байтах. Сильно сжатый JPEG 2048² и четкий PNG 2048² стоят одинаковое количество токенов; имеют значение только ширина и высота.

Как максимально сократить затраты на ввод изображений?

Уменьшите масштаб до наименьшего разрешения, которое по-прежнему отображает необходимую вам детализацию, и используйте режим низкой детализации там, где для задачи требуется только суть. Вместе эти два рычага обычно сокращают затраты на видение в несколько раз.

Это точные формулы поставщика?

Это точные эталонные реализации опубликованных правил тайлов и пикселей 2026 года, но поставщики их дорабатывают и пересматривают. Считайте количество токенов точными оценками и сверяйте их с собственным токенизатором вашего провайдера для получения номеров уровня выставления счетов.

А что насчет видео?

Видео обычно оплачивается как последовательность выборочных кадров, каждый из которых оценивается как изображение. Оцените частоту кадров в секунду в образцах модели, умножьте на секунды и обрабатывайте каждый кадр в этом инструменте как одно изображение.

Только оценить. Изменяются токенизация Vision и ставки ввода на миллион — уточните у своего провайдера, прежде чем полагаться на эти цифры.

Разместите свой проект:DigitalOcean — 200 долларов бесплатно ↗Хостингер VPS
Гугл БлизнецыМонетаGeckoAI и LLMКриптовалютные биржиПлатежи