Cerebras は、ウエハースケールのハードウェア上でオープン モデルを実行します。 グロク その売りは、独自のフロンティア モデルではなくスループットです。出力トークンは、音声エージェントや対話型ツールの感触を変えるのに十分な速さで到着します。請求は通常のトークンごとの料金設定であるため、興味深い問題は、速度がワークロードのトークンごとのレートに見合うかどうかです。
| モデル | $/1M を入力 | 出力 $/1M | こんな方に最適 |
|---|---|---|---|
| GPT-OSS-120B | $0.35 | $0.75 | 高速汎用オープンモデル |
| ZAI-GLM-4.7 | $2.25 | $2.75 | より高い機能層 |
| カタログ範囲 | $0.50–$1.50 | 変化する | ホストされているほとんどのモデルがこのバンドに属します |
→ 請求書を見積もる APIコスト計算ツール または、アプリ全体をモデル化します。 AI アプリのコスト見積りツール.
はい。 Cerebras が提供するのは、 無料の開発者層 構築と評価に適したレート制限があり、事前にカードを支払う必要はありません。セルフサービス 開発者 ティアは約から始まります $10 リクエストのスケジューリング優先度を高めながら、レート制限を約 10 倍に引き上げます。無料クォータがメインのフィルターである場合は、以下と比較してください。 グロク, ジェミニ そして ミストラル で 無料 API 層ページ.
1. でサインアップしてください クラウド.セレブラス.ai.
2. 開ける APIキー そしてキーを作成します。キーを一度コピーすると、再度表示されません。
3. 無料利用枠から始めてください。を追加します 10ドルの開発者 レート制限がボトルネックになる場合の階層。
4. エンドポイントは OpenAI と互換性があるため、ベース URL とキーを変更することで既存の OpenAI SDK コードが機能します。
テストしてみましょう:
生の速度が要件ではない場合、ほとんどすべてのものがトークンあたり安くなります。 ディープシーク そして グロックス 小型のラマ モデルは通常、低予算で選ばれます。 オープンルーター プロバイダー間で 1 つのキーが提供されるため、複数のプロバイダーで同じプロンプトを A/B できます。遅延が真に収益を生み出す場合、音声エージェント、インタラクティブ コーディング ツールでは、低速オプションのコストを適切にモデル化します。 LLM レイテンシ計算ツール 安いプロバイダーが勝つと考える前に。
はい。 Cerebras Inference には、ビルドとテストに十分なレート制限のある無料の開発者層があり、カードは必要ありません。セルフサービスの開発者レベルへの移行には約 10 ドルの費用がかかり、約 10 倍のレート制限とより高い優先度の処理が解除されます。
参考価格 (2026 年 7 月): GPT-OSS-120B は 100 万トークンあたりインプット約 0.35 ドル / アウトプット $0.75 で、ZAI-GLM-4.7 は約 2.25 ドル / 2.75 ドルです。カタログ全体で、ほとんどのモデルは 100 万あたり 0.50 ドルから 1.50 ドルの範囲に収まり、他のプロバイダーと同様に、公開されているレート表に対して入力および出力トークンごとに請求されます。
Cloud.cerebras.ai でアカウントを作成し、[API キー] セクションを開いてキーを生成し、それを一度コピーします。無料利用枠はすぐに有効になります。レート制限が厳しくなり始めたら、10 ドルの開発者層を追加してください。
どちらもオープン モデルでの速度が売りであり、どちらもコモディティ GPU 推論よりもはるかに高速です。必要な特定のモデルを比較してください。カタログが異なるため、一方で入手可能なモデルが他方では入手できない場合があります。両方が同じモデルをホストしている場合は、価格だけではなく、1 秒あたりのトークンと 100 万あたりのレートを比較します。
セレブラスとは無関係です。価格は参考見積りです。必ず公式の価格ページでご確認ください。