プロバイダーを月額料金でランキング
選択したモードのページごとの料金。 LLM ビジョン プロバイダーは、1 回の呼び出しで OCR と構造化抽出の両方を行うため、同じ料金で行います。
| # | プロバイダー | ページごと | 毎月 | 無料利用枠 |
|---|
普通の OCR は商品です。構造化された抽出で料金が大きくなる
主要な OCR プロバイダーはすべて、ほぼ同じ金額でページのテキストを読み取ります。 1,000 ページあたり 1 ドルから 1.50 ドル。そう考えると、OCR は本質的には解決済みの商品であり、選択はドキュメントの種類と既に使用しているクラウドの精度によって決まります。コストの崖は思った瞬間に現れる 構造: フォームのキーと値のペア、テーブルのセル、請求書の明細項目。 AWS Textract の AnalyzeDocument、Google の Form Parser、Azure の事前構築/カスタム モデルの料金 普通の OCR レートの 10 ~ 30 倍 なぜなら、読み取りに加えてレイアウト分析を実行するからです。 Document AI の料金を削減する唯一最大の方法は、本当に構造が必要なページのみを高価なパスにルーティングし、それ以外はすべて安価な OCR にルーティングすることです。
LLM のビジョンが適合する場所
GPT-4o とジェミニビジョンは数学を変えました。ページあたりのコストはコモディティ OCR よりも高くなりますが、 1 回の呼び出しで構造化された JSON を読み取り、抽出します、OCR ステップと別の解析ステップを 1 つにまとめます。現在、パイプラインが「OCR → 正規表現/解析 → クリーンアップ」を実行している場合、LLM-vision 呼び出しは 3 つすべてを置き換えることができ、多くの場合 Textract のフォーム価格よりもエンドツーエンドで安くなります。ただし、LLM のコストは画像の解像度と返される JSON の長さに応じて変化することに注意してください。トークン側をモデル化します。 LLM トークンコスト計算ツール そして 視覚入力 大規模にコミットする前に。
OCRをスタックコストの残りの部分に組み込む
OCR が単独で機能することはほとんどありません。通常、抽出されたテキストは、要約、分類、または質問への回答のために LLM に流れ込み、実際の支出のほとんどはここで行われます。下流コストがかかるサイズ RAG コスト計算ツール または チャットボットのコスト計算ツール、パイプライン全体をロールアップします。 APIスタックコスト計算ツール。ページごとに 0.001 ドルで読めるのは安い部分です。それらを理解するために費やすトークンの数がユニットエコノミクスを決定します。
使い方
1. 1 か月あたりに処理するページ数を入力します。
2. プレーンな OCR またはフォームとテーブルを選択します。これにより、すべてのプロバイダーが適切なレートに切り替わります。
3. 最安のオプション、ページごとのコスト、および最も高価なプロバイダーに支払うといくら過剰になるかを確認してください。
よくある間違い
OCR作業に対するフォーム料金の支払い。 テキストのみが必要な場合は、AnalyzeDocument/Form Parser を決して呼び出さないでください。プレーンな OCR エンドポイントの価格は数分の一です。 無料枠を無視します。 Azure、Google、AWS はすべて、小規模なワークロードを完全にカバーする毎月の無料ページを提供しています。 LLM ビジョンの解像度を忘れています。 高詳細画像モードでは、ページあたりのトークン コストが倍増します。精度が許す限りダウンスケールします。 同じドキュメントを再処理します。 OCR 出力をキャッシュして、パイプラインの再実行によってすべてのページに再請求が行われないようにします。
見積もりのみ。料金は 2026 年の参考値であり、変更されます。契約する前に、現在のページあたりの料金を各プロバイダーに確認してください。