AIモデルとプラットフォーム
LlamaIndex、ドキュメント解析用の統合API「OpenDocRouter」を発表

LlamaIndexは2026年10月7日にOpenDocRouterをローンチしました。これは、フロンティアモデルとオープンソースモデルのセットを単一のAPIの背後に配置し、バージョン管理されたパーシングレシピで実行され、品質とコストについてParseBenchでベンチマークされた、ドキュメントからMarkdownへの変換を提供するホスト型プラットフォームです。
LlamaIndexは、このサービスを、特に得意とする作業を共有するために構築したと述べています。この発表は、競争が激しい市場を示しています。HuggingFaceで「ocr」を検索すると何千ものモデルがヒットし、フロンティアラボはほぼ毎月ドキュメント対応モデルをリリースしています。これらのモデルを利用するには、プロンプトの設定やレートリミットの処理、デプロイや関連コストの管理、そして新モデルが登場するたびにベンチマークを行うという、同じ数ステップが通常必要です。
製品ホームページでは、OpenDocRouterがPDFや画像をMarkdownに変換する統合APIとして提示されています。ページは容量が確保でき次第、個別のモデル呼び出しとして実行され、各ページはそれぞれのMarkdown、ステータス、料金を返します。失敗したページは個別に再試行でき、ページ選択機能により呼び出し側は既に取得したページをスキップできます。
ローンチラインナップとParseBenchスコア
ローンチ時点で、APIは5つのフロンティアモデル(Claude Opus 5.5、Gemini 3 Flash、Gemini 3.8 Flash、GPT-5.6 Terra、GPT-6 Luna)と5つのオープンソースモデル(Infinity-Parser2-Flash、MinerU2.5-Pro、TeleOCR、dots.mocr、PaddleOCR-VL-1.6)を提供しています。LlamaIndexは、ベンチマークのすべての領域を網羅するようにローンチセットを選択したと述べ、各モデルは品質とコストの両面でParseBenchでベンチマークされていると付け加えました。
モデルとベンチマークページでは、ParseBenchの結果が5つのカテゴリ(テーブル、チャート、忠実度、フォーマット、グラウンディング)で報告され、Overallスコアはこれら5つの平均として定義されています。Claude Opus 5.5はOverallスコア84.20、テーブルで93.53、忠実度で91.03、1,000ページあたり$48.82で掲載されています。GPT-6 LunaはOverall 71.34、1,000ページあたり$0.80、MinerU2.5-Proは70.05と$0.86、TeleOCRは57.25と$2.70です。ページによれば、1,000ページあたりの価格は、ParseBenchの文書全体で各モデルがページごとに使用したトークン数に基づく現在の価格で、典型的な1,000ページのコストを示しています。ユーザー自身のページはトークン使用量が多い場合も少ない場合もあり、掲載価格は2026年10月6日のバージョン日付が付与されています。
各モデルのパーシングレシピにはバージョンが付与されており、出力が変わるたびに更新されます。モデルページのトークン価格表では、Claude Opus 5.5とGPT-5.6 Terraのバージョン日は2026年9月25日、GPT-6 Lunaは2026年10月5日となっています。LlamaIndexは、新しいモデルが提供可能になると、ParseBenchでプロンプト、コスト、その他の設定を調整した上で追加すると述べ、また、最も人気のあるモデルは、プロンプトの改善とホスティングの最適化によりレイテンシを低減しながら継続的に改善していく計画だと付け加えました。
APIの仕組みとグラウンディングエンジン
APIはPDF、PNG、JPEGファイル、またはそれらの形式へのURLを、POST /v1/parse エンドポイントを通じて受け付けます。APIドキュメントによれば、ドキュメントは公開HTTPS URLまたはアップロードされたファイルIDとして送信でき、いずれも最大50 MBまたは500ページまで、または約3 MBまでのインラインBase64データとして送信できます。リクエストは最大50ページまで同期的に実行され、より大きなドキュメントはキャッシュが必要な非同期モードで最大500ページまで処理され、オプションのpagesフィールド(例: “1-3,7″)で特定ページを選択できます。レスポンスは完了、部分的、失敗のステータスを持ち、ページごとのMarkdownとトークン使用量を含みます。
型付けされたPythonおよびTypeScript SDKはpipとnpmでインストールでき、ソースはrun-llama/opendocrouter-pyおよびrun-llama/opendocrouter-tsのGitHubリポジトリにあり、エンドポイントを鏡像するメソッド(parse.create、uploads.create、credits.get、models.listなど)を提供します。
モデルによってバウンディングボックスやレイアウトに関する保証が異なる(いくつかはボックスをネイティブに出力し、いくつかはプロンプトが必要で、全く対応できないものもある)ため、LlamaIndexは任意のモデルに適用できるグラウンディングエンジンを構築しました。layout: true を設定すると、読み順に整列したバウンディングボックスとレイアウト要素を含むMarkdownが返され、共通のレイアウトクラス(title、section_header、text、list_item、table、picture、chart、formula、caption、footnote、page_header、page_footer、code、form、key_value)が適用されます。ボックスの座標はページ左上からの割合で示され、要素は信頼度を持ち、レイアウトが失敗したページはレイアウト料金なしでMarkdownのみが保持されます。
保持に関して、ドキュメントの内容はキャッシュが有効でない限り保持されないとドキュメントに記載されています。キャッシュされた結果は24時間暗号化保存され、削除呼び出しでそれより早く削除できます。同一ドキュメントの同一ページを同一モデル・レイアウト設定で再度リクエストすると、キャッシュから無料で提供されます。サービスはタイムアウト、レートリミット、プロバイダーエラー、容量不足、モデルがループするまたは文字起こしできない場合に各ページを1回再試行します。アカウントの制限は、同時リクエスト10件(うち5件は非同期可能)、1分あたり300件のパース呼び出しと60件のポーリング呼び出し、ページあたり270秒のタイムアウト、非同期リクエストの容量待ち時間は最大30分です。
価格設定、請求、およびLlamaParseの違い
OpenDocRouterはトークン単位でのみ課金されます。アカウントは$25からのプリペイドクレジットをチャージでき、各チャージにつき5%の手数料がかかります。フロンティアモデルはプロバイダーのトークン価格でマークアップなしで課金され、レイアウト機能を有効にすると、レイアウトが成功したページにつき100万トークンあたり$0.20が加算されます。失敗したページ、キャッシュされたページ、空白ページは無料です。開始するには、リクエストが最大料金をカバーできるだけのクレジットを保持している必要があります。最大料金は、モデルのページあたりの最高料金にページ数を掛けたものとして定義され、使用されなかった分はリクエスト完了時に解放されます。
発表の価格表(2026年10月7日付)では、Claude Opus 5.5が入力トークン100万件あたり$4.00、出力トークン100万件あたり$20.00、GPT-6 Lunaが入力トークン100万件あたり$0.10、出力トークン100万件あたり$0.50、MinerU2.5‑Proが入力トークン100万件あたり$0.08、出力トークン100万件あたり$0.39と掲載されています。
LlamaIndexは新サービスとLlamaParse(同社のマネージド文書プラットフォーム)を区別しています。同社の説明によれば、OpenDocRouterは最新モデルを迅速にホストできるプラットフォームで、開発者はモデル間を切り替えてルーティングでき、使用した分だけ支払う仕組みです。一方、LlamaParseは手調整されたパーシング層、エンタープライズ向けコントロール、セルフホスト展開、スキーマ抽出やインデックス作成といった追加APIを提供します。
OpenDocRouterは稼働中で、LlamaIndexはユーザーにモデルとドキュメントを閲覧し、サインアップしてAPIキーを生成し、パーシングを開始するよう案内しています。












