Modele i platformy AI
LlamaIndex uruchamia OpenDocRouter, zunifikowane API do przetwarzania dokumentów

LlamaIndex 7 października 2026 uruchomiło OpenDocRouter, platformę hostowaną do przetwarzania dokumentów na markdown, która umieszcza zestaw najnowocześniejszych i otwarto‑źródłowych modeli za jednym API, przy czym każdy jest uruchamiany według wersjonowanego przepisu parsowania i benchmarkowany w ParseBench pod kątem jakości i kosztów.
LlamaIndex powiedziało, że stworzyło usługę, aby udostępnić pracę, w której osiągnęło szczególną biegłość. Ogłoszenie wskazuje na zatłoczone pole: wyszukiwanie „ocr” na HuggingFace zwraca tysiące modeli, laboratoria najnowocześniejsze wypuszczają modele zdolne do przetwarzania dokumentów niemal co miesiąc, a korzystanie z tych modeli zazwyczaj wymaga tych samych kilku kroków, od opracowywania promptów i obsługi limitów szybkości po zarządzanie wdrożeniami i powiązanymi kosztami oraz benchmarkowanie nowych modeli w miarę ich pojawiania się.
Na stronie produktu OpenDocRouter przedstawiony jest jako zunifikowane API do przetwarzania dokumentów, które zamienia pliki PDF i obrazy na markdown. Strony są przetwarzane jako oddzielne wywołania modeli w miarę dostępności zasobów, a każda strona zwraca własny markdown, status i opłatę. Nieudane strony mogą być ponownie przetworzone osobno, a wybór stron pozwala wywołującemu pominąć już posiadane strony.
Oferta startowa i wyniki ParseBench
Na start API oferuje pięć najnowocześniejszych modeli (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra i GPT-6 Luna) oraz pięć modeli otwarto‑źródłowych (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr oraz PaddleOCR-VL-1.6). LlamaIndex poinformowało, że wybrało zestaw startowy, aby objąć wszystkie obszary swoich benchmarków, i że każdy model jest benchmarkowany w ParseBench pod względem jakości i kosztów.
Na stronie modeli i benchmarków podano wyniki ParseBench w pięciu kategoriach (Tabele, Wykresy, Wierność, Formatowanie i Ugruntowanie) oraz określono wynik Ogólny jako średnią z pięciu. Claude Opus 5.5 ma wynik Ogólny 84,20, w tym 93,53 w Tabelach i 91,03 w Wierności, przy cenie 48,82 $ za 1 000 stron. GPT-6 Luna uzyskuje 71,34 Ogólny i 0,80 $ za 1 000 stron, MinerU2.5-Pro – 70,05 i 0,86 $, a TeleOCR – 57,25 i 2,70 $. Według strony, wartość za 1 000 stron odzwierciedla koszt 1 000 typowych stron przy bieżących cenach, oparty na liczbie tokenów używanych przez każdy model na stronę w dokumentach ParseBench, a własne strony użytkownika mogą zużywać więcej lub mniej tokenów; podane ceny mają datę wersji 6 października 2026.
Przepis parsowania każdego modelu posiada wersję, która zmienia się za każdym razem, gdy jego wyjście może ulec zmianie. W tabeli token‑cena na stronie modeli, Claude Opus 5.5 i GPT-5.6 Terra mają datę wersji 25 września 2026, natomiast GPT-6 Luna – 5 października 2026. LlamaIndex poinformowało, że gdy pojawią się nowe modele, które może zaoferować, poddaje je ParseBench w celu skalibrowania promptów, kosztów i innych ustawień przed ich dodaniem, i planuje dalej ulepszać najpopularniejsze modele poprzez lepsze promptowanie oraz lepszy hosting w celu zmniejszenia opóźnień.
Mechanika API i silnik ugruntowania
API przyjmuje pliki PDF, PNG i JPEG lub adresy URL do tych formatów, poprzez endpoint POST /v1/parse. Zgodnie z dokumentacją API, dokument może być przesłany jako publiczny adres HTTPS lub jako ID przesłanego pliku, przy czym każdy jest ograniczony do 50 MB lub 500 stron, lub jako wbudowane dane base64 do około 3 MB. Żądania są wykonywane synchronicznie do 50 stron; większe dokumenty są przetwarzane asynchronicznie, do 500 stron z wymaganą pamięcią podręczną, a opcjonalne pole pages, np. „1-3,7”, wybiera konkretne strony. Odpowiedź zawiera status: zakończone, częściowe lub niepowodzenie, wraz z markdownem i zużyciem tokenów dla każdej strony.
Typowane SDK w Pythonie i TypeScript instalowane są za pomocą pip i npm, a ich kod źródłowy znajduje się w repozytoriach GitHub run-llama/opendocrouter-py oraz run-llama/opendocrouter-ts, zawierających metody odzwierciedlające endpointy, w tym parse.create, uploads.create, credits.get i models.list.
Ponieważ modele dają różne gwarancje dotyczące ramek ograniczających i układu (niektóre natywnie zwracają ramki, niektóre wymagają promptu, a niektóre w ogóle tego nie potrafią), LlamaIndex stworzyło silnik ugruntowania, który może być zastosowany do dowolnego modelu. Ustawienie layout: true zwraca markdown z ugruntowanymi ramkami i elementami układu w kolejności czytania, w ramach wspólnego zestawu klas układu: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form oraz key_value. Współrzędne ramki są ułamkami strony mierzone od jej lewego górnego rogu, elementy zawierają wartości pewności, a strona, której układ się nie powiódł, zachowuje markdown bez opłaty za układ.
W dokumentacji dotyczącej przechowywania zaznaczono, że żadne dane z dokumentu nie są zachowywane, chyba że włączono buforowanie; wyniki w pamięci podręcznej są przechowywane zaszyfrowane przez 24 godziny, wywołanie usuwające usuwa je szybciej, a późniejsze żądania tych samych stron tego samego dokumentu przy tym samym modelu i ustawieniu układu są obsługiwane z pamięci podręcznej bez opłat. Usługa ponawia każde żądanie strony raz w przypadku przekroczenia limitu czasu, limitów szybkości, błędów dostawcy lub braku dostępnych zasobów, oraz gdy model zapętla się lub nie transkrybuje. Limity konta obejmują 10 równoczesnych żądań, z czego pięć może być asynchronicznych, 300 wywołań parsowania i 60 wywołań pollingowych na minutę, limit czasu 270 sekund na stronę oraz oczekiwanie do 30 minut na dostępność zasobów przy żądaniach asynchronicznych.
Cennik, rozliczenia i różnica LlamaParse
OpenDocRouter rozlicza wyłącznie za tokeny. Konta doładowują przedpłacone kredyty zaczynając od $25, przy opłacie 5% od każdego doładowania; modele frontier są obciążane cenami tokenów ich dostawców bez dodatkowej marży; a włączenie układu dodaje $0.20 za milion tokenów na stronach, których układ się powiódł. Nieudane, zbuforowane i puste strony są darmowe. Aby rozpocząć, żądanie musi posiadać wystarczający kredyt, aby pokryć maksymalny koszt, definiowany jako najwyższa stawka modelu za stronę pomnożona przez liczbę stron, a niewykorzystane przez strony środki są zwalniane po zakończeniu żądania.
Tabela cenowa ogłoszenia, datowana na 7 października 2026, wymienia Claude Opus 5.5 po $4.00 za milion tokenów wejściowych i $20.00 za milion tokenów wyjściowych, GPT-6 Luna po $0.10 za milion tokenów wejściowych i $0.50 za milion tokenów wyjściowych oraz MinerU2.5-Pro po $0.08 za milion tokenów wejściowych i $0.39 za milion tokenów wyjściowych.
LlamaIndex wyznacza granicę między nową usługą a LlamaParse, swoją zarządzaną platformą dokumentacyjną. W ujęciu firmy, OpenDocRouter jest platformą do szybkiego hostowania najnowszych modeli, umożliwiającą deweloperom przełączanie i kierowanie ruchem między nimi przy płaceniu wyłącznie za to, co wykorzystują, podczas gdy LlamaParse oferuje ręcznie dostrojone poziomy parsowania, kontrolę przedsiębiorstwa, samodzielne wdrożenia oraz dodatkowe API, takie jak ekstrakcja schematów i indeksowanie.
OpenDocRouter jest dostępny, a LlamaIndex kieruje użytkowników do przeglądania modeli i dokumentacji, rejestracji, generowania klucza API oraz rozpoczęcia parsowania.












