LLM API の価格設定の仕組み

トークン、入力と出力、コンテキスト ウィンドウ — 同じタスクが、あるモデルでは別のモデルの 50 倍のコストがかかる理由を簡単に説明します。

AIモデル › GPT-4o mini 対 Gemini 2.5 フラッシュ

GPT-4o mini vs Gemini 2.5 Flash: 価格比較

2026 年の実際の API 価格と、一般的な月次ワークロード 1,000 万入力 / 300 万出力の総コストを並べて表示します。

価格とコストが一目でわかる

GPT-4oミニジェミニ 2.5 フラッシュ
入力 / 1M トークン$0.15$0.3
出力 / 100万トークン$0.6$2.5
コンテキストウィンドウ128K1000K
コスト — 入力 1000 万 + 出力 300 万$3.3$10.5

緑 = 安い/大きい。 100万トークンあたりの価格、米ドル。スナップショット 2026 — プロバイダーに確認してください。

どちらが安いですか?

GPT-4oミニ 10M 入力 / 3M 出力のワークロードでは、こちらの方が安価なオプションです。Gemini 2.5 フラッシュの場合は月額 10.5 ドルであるのに対し、月額約 3.3 ドルです (約 3.2 倍の差)。出力トークンの請求額が高くなるため、より低いモデルの方が請求されます。 出力 通常、応答が長くなるほど価格が優先されます。

独自のトークン ミックスを実行します。 コスト計算機、または各モデルを詳しく参照してください。 GPT-4oミニ · ジェミニ 2.5 フラッシュ.

よくある質問

GPT-4o mini または Gemini 2.5 Flash はどちらが安いですか?

一般的な月あたり 1,000 万の入力 + 300 万の出力トークンの場合、GPT-4o mini の費用は約 3.3 ドルですが、Gemini 2.5 フラッシュの場合は 10.5 ドルです。このワークロードでは GPT-4o mini の方が約 3.2 倍安くなります。入力トークンと出力トークンの比率によってギャップが変わります。

GPT-4o mini と Gemini 2.5 Flash の価格の違いは何ですか?

GPT-4o mini は 100 万入出力トークンあたり 0.15 ドル/0.6 ドルです。 Gemini 2.5 フラッシュは 0.3 ドル/2.5 ドルです。通常、出力トークンが請求額の大部分を占めるため、最初に出力価格を比較します。

GPT-4o mini と Gemini 2.5 Flash ではどちらのコンテキスト ウィンドウが大きいですか?

GPT-4o mini は約 128K のトークン、Gemini 2.5 フラッシュは約 1000K をサポートします。ウィンドウが大きいほど、コンテキスト内のすべてのトークンが課金されるため、呼び出しごとのコストが高くなります。

教育上の見積もり — どのプロバイダーとも提携していません。