Cerebras запускает открытые модели на оборудовании размером с пластину и т. д. Грок его суть заключается в пропускной способности, а не в собственной передовой модели: выходные токены поступают достаточно быстро, чтобы изменить ощущения голосового агента или интерактивного инструмента. Биллинг представляет собой обычную цену за токен, поэтому интересный вопрос заключается в том, соответствует ли скорость ставке за токен для вашей рабочей нагрузки.
| Модель | Ввод $/1 млн. | Выход $/1 млн. | Лучшее для |
|---|---|---|---|
| ГПТ-ОСС-120Б | $0.35 | $0.75 | Быстрая открытая модель общего назначения |
| ЗАИ-ГЛМ-4.7 | $2.25 | $2.75 | Уровень более высоких возможностей |
| Ассортимент каталога | $0.50–$1.50 | варьируется | Большинство хостинговых моделей находятся в этой группе. |
→ Оцените свой счет на Калькулятор стоимости API или смоделируйте целое приложение с помощью Оценщик стоимости приложения с искусственным интеллектом.
Да. Церебрас предлагает бесплатный уровень разработчика с ограничениями скорости, подходящими для построения и оценки, без предварительной карты. Самообслуживание Разработчик уровень начинается примерно с $10 и повышает ограничения скорости примерно в десять раз, одновременно давая вашим запросам более высокий приоритет планирования. Если бесплатная квота является вашим основным фильтром, сравните ее с Грок, Близнецы и Мистраль на страница бесплатных уровней API.
1. Зарегистрируйтесь на Cloud.cerebras.ai.
2. Открыть API-ключи и создайте ключ — скопируйте его один раз, больше он не отображается.
3. Начните с бесплатного уровня; добавить Разработчик за 10 долларов уровень, когда ограничения по ставкам становятся узким местом.
4. Конечная точка совместима с OpenAI, поэтому существующий код OpenAI SDK работает путем изменения базового URL-адреса и ключа.
Проверьте это:
Если чистая скорость не является обязательным требованием, практически все обходится дешевле за токен: ДипСик и Грока маленькие модели Llama — обычный бюджетный выбор, и OpenRouter дает вам один ключ для всех поставщиков, поэтому вы можете использовать одно и то же приглашение для нескольких поставщиков. Там, где задержка действительно увеличивает доход (голосовые агенты, инструменты интерактивного кодирования), правильно моделируйте стоимость более медленного варианта с помощью Калькулятор задержки LLM прежде чем предположить, что победит дешевый провайдер.
Да. Cerebras Inference имеет бесплатный уровень разработчика с ограничениями скорости, которых достаточно для сборки и тестирования, без необходимости использования карты. Переход на уровень разработчика с самообслуживанием стоит около 10 долларов США и открывает примерно в 10 раз более высокие ограничения скорости, а также обработку с более высоким приоритетом.
Справочная цена (июль 2026 г.): GPT-OSS-120B составляет около 0,35 доллара США на входе / 0,75 доллара США на выходе за миллион токенов, а ZAI-GLM-4,7 — около 2,25 доллара США / 2,75 доллара США. В каталоге большинство моделей попадают в диапазон от 0,50 до 1,50 доллара за миллион, при этом счета выставляются за каждый входной и выходной токен по опубликованному тарифу, как и у любого другого поставщика.
Создайте учетную запись на сайте cloud.cerebras.ai, откройте раздел «Ключи API», сгенерируйте ключ и скопируйте его один раз. Уровень бесплатного пользования активируется немедленно; добавьте уровень разработчика за 10 долларов США, когда ваши ограничения по скорости начнут кусаться.
Оба продают скорость на открытых моделях, и оба намного быстрее, чем вывод обычных графических процессоров. Сравните на конкретной модели, которая вам нужна — каталоги различаются, и модель, доступная в одном, может отсутствовать в другом. Если обе используют одну и ту же модель, сравнивайте количество токенов в секунду со скоростью за миллион, а не только с ценой.
Не связан с Церебрасом. Цены являются справочными — всегда проверяйте их на официальной странице цен.
Обмены
Инструменты и хостинг