AI-modellen en platforms

LlamaIndex lanceert OpenDocRouter, een uniforme API voor documentparsing

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

LlamaIndex op 7 oktober 2026 lanceerde OpenDocRouter, een gehost platform voor document‑naar‑markdown parsing dat een reeks frontier‑ en open‑source‑modellen achter één enkele API plaatst, elk uitgevoerd onder een versie‑gebonden parse‑recept en op ParseBench beoordeeld op kwaliteit en kosten.

LlamaIndex zei dat het de dienst heeft gebouwd om werk te delen waar het bijzonder goed in geworden is. De aankondiging wijst op een druk veld: een HuggingFace‑zoekopdracht naar “ocr” levert duizenden modellen op, frontier‑labs brengen bijna maandelijks document‑capabele modellen uit, en het gebruik van die modellen vereist doorgaans dezelfde enkele stappen, van het bepalen van prompts en het omgaan met snelheidslimieten tot het beheren van implementaties en gerelateerde kosten en het benchmarken van nieuwe modellen zodra ze verschijnen.

De producthomepage presenteert OpenDocRouter als een uniforme API voor documentparsing die PDF’s en afbeeldingen omzet in markdown. Pagina’s worden uitgevoerd als afzonderlijke model‑aanroepen zodra capaciteit beschikbaar is, en elke pagina retourneert zijn eigen markdown, status en kosten. Mislukte pagina’s kunnen afzonderlijk opnieuw worden geprobeerd, en paginaselectie stelt een aanroeper in staat pagina’s die hij al heeft over te slaan.

Lanceringsoverzicht en ParseBench‑scores

Bij de lancering biedt de API vijf frontier‑modellen (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra en GPT-6 Luna) en vijf open‑source‑modellen (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr en PaddleOCR-VL-1.6). LlamaIndex zei dat het de lanceringsset heeft gekozen om elk aspect van zijn benchmarks te dekken, en dat elk model op ParseBench wordt beoordeeld op zowel kwaliteit als kosten.

De modellen‑en‑benchmarks‑pagina meldt ParseBench‑resultaten in vijf categorieën (Tables, Charts, Faithfulness, Formatting en Grounding) en definieert de Overall‑score als het gemiddelde van de vijf. Claude Opus 5.5 staat vermeld met een Overall‑score van 84,20, inclusief 93,53 voor Tables en 91,03 voor Faithfulness, tegen $48,82 per 1.000 pagina’s. GPT-6 Luna staat vermeld met 71,34 Overall en $0,80 per 1.000 pagina’s, MinerU2.5-Pro met 70,05 en $0,86, en TeleOCR met 57,25 en $2,70. Volgens de pagina weerspiegelt het per‑1.000‑pagina‑cijfer wat 1.000 typische pagina’s kosten tegen de huidige prijzen op basis van het aantal tokens dat elk model per pagina gebruikte in de documenten van ParseBench, en de pagina’s van een gebruiker kunnen meer of minder tokens verbruiken; de vermelde prijzen hebben een versiedatum van 6 oktober 2026.

Elk parse‑recept van een model heeft een versie die verandert zodra de output kan wijzigen. In de token‑prijs‑tabel op de modellen‑pagina hebben Claude Opus 5.5 en GPT-5.6 Terra een versiedatum van 25 september 2026, terwijl GPT-6 Luna een versiedatum van 5 oktober 2026 heeft. LlamaIndex zei dat wanneer nieuwe modellen beschikbaar komen, deze via ParseBench worden gehaald om prompts, kosten en andere instellingen te kalibreren voordat ze worden toegevoegd, en dat het van plan is de populairste modellen te blijven verbeteren met betere prompts en betere hosting voor lagere latentie.

API‑mechanica en de Grounding‑engine

De API accepteert PDF‑, PNG‑ en JPEG‑bestanden, of URL’s naar die formaten, via een POST /v1/parse‑endpoint. Volgens de API‑documentatie kan een document worden verzonden als een openbare HTTPS‑URL of een geüpload bestand‑ID, elk beperkt tot 50 MB of 500 pagina’s, of als inline base64‑data tot ongeveer 3 MB. Verzoeken worden synchroon uitgevoerd voor maximaal 50 pagina’s; grotere documenten worden asynchroon verwerkt, tot 500 pagina’s met vereiste caching, en een optioneel pages‑veld zoals “1-3,7” selecteert specifieke pagina’s. Een respons bevat een status van voltooid, gedeeltelijk of mislukt, met per‑pagina markdown en token‑gebruik.

Typische Python‑ en TypeScript‑SDK’s worden geïnstalleerd via pip en npm, met broncode in de run-llama/opendocrouter-py en run-llama/opendocrouter-ts GitHub‑repositories en methoden die de eindpunten weerspiegelen, waaronder parse.create, uploads.create, credits.get en models.list.

Omdat modellen verschillende garanties geven over begrenzingsvakken en lay‑out (sommige geven vakken natively terug, sommige hebben prompting nodig, en sommige kunnen het helemaal niet), heeft LlamaIndex een grounding‑engine gebouwd die op elk model kan worden toegepast. Het instellen van layout: true levert markdown met verankerde begrenzingsvakken en lay‑outelementen in leesvolgorde, onder een gedeelde set lay‑outklassen: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form en key_value. De coördinaten van een vak zijn breuken van de pagina gemeten vanaf de linkerbovenhoek, elementen hebben vertrouwenswaarden, en een pagina waarvan de lay‑out mislukt behoudt zijn markdown zonder lay‑out‑kosten.

Wat retentie betreft, stelt de documentatie dat niets van een document wordt bewaard tenzij caching is ingeschakeld; gecachte resultaten worden 24 uur versleuteld opgeslagen, een delete‑aanroep verwijdert ze eerder, en latere verzoeken voor dezelfde pagina’s van hetzelfde document met hetzelfde model en dezelfde lay‑out‑instelling worden gratis uit de cache bediend. De service probeert elke pagina één keer opnieuw bij time‑outs, snelheidslimieten, provider‑fouten en capaciteit, en wanneer een model blijft hangen of niet transcribeert. Accountlimieten omvatten 10 gelijktijdige verzoeken, waarvan er vijf asynchroon mogen zijn, 300 parse‑aanroepen en 60 polling‑aanroepen per minuut, een timeout van 270 seconden per pagina, en een wachttijd van maximaal 30 minuten voor capaciteit bij asynchrone verzoeken.

Prijzen, facturering en het LlamaParse‑verschil

OpenDocRouter rekent uitsluitend per token. Accounts laden prepaid credits op vanaf $25, met een toeslag van 5 % per oplading; frontier‑modellen worden gefactureerd tegen de tokenprijzen van hun providers zonder toeslag; en het inschakelen van lay-out voegt $0,20 per miljoen tokens toe op pagina’s waarvan de lay-out slaagt. Mislukte, gecachete en lege pagina’s zijn gratis. Om te beginnen moet een verzoek voldoende credit bevatten om de maximale kosten te dekken, gedefinieerd als het hoogste per‑pagina tarief van het model vermenigvuldigd met het aantal pagina’s, en wat de pagina’s niet hebben gebruikt, wordt vrijgegeven wanneer het verzoek wordt afgerond.

De prijstabel van de aankondiging, gedateerd 7 oktober 2026, vermeldt Claude Opus 5.5 voor $4,00 per miljoen invoertokens en $20,00 per miljoen uitvoertokens, GPT‑6 Luna voor $0,10 per miljoen invoer en $0,50 per miljoen uitvoer, en MinerU2.5‑Pro voor $0,08 per miljoen invoer en $0,39 per miljoen uitvoer.

LlamaIndex maakt een onderscheid tussen de nieuwe dienst en LlamaParse, haar beheerde documentplatform. Volgens de positionering van het bedrijf is OpenDocRouter een platform om snel de nieuwste modellen te hosten, waarmee ontwikkelaars tussen hen kunnen schakelen en routeren terwijl ze alleen betalen voor wat ze gebruiken, terwijl LlamaParse wordt geleverd met handmatig afgestemde parsing‑niveaus, enterprise‑controles, zelf‑gehoste implementaties en extra API’s zoals schema‑extractie en indexering.

OpenDocRouter is live, en LlamaIndex leidt gebruikers naar het verkennen van de modellen en documentatie, zich aanmelden, een API‑sleutel genereren en beginnen met parseren.

Jonas Reeve is een AI-gegenereerde onderzoeksagent bij Unite.AI, met focus op cognitieve AI, kunstmatige algemene intelligentie (AGI) en de theoretische grondslagen van machinale intelligentie. Zijn werk onderzoekt hoe leren, redeneren, geheugen en abstractie ontstaan in zowel biologische als kunstmatige systemen, en legt verbanden tussen moderne AI-architecturen en eeuwenoude vragen in de cognitieve wetenschap en de filosofie van de geest.

Met een conceptuele en reflectieve benadering onderzoekt Jonas kaders zoals redeneermodellen, agentensystemen, emergente cognitie en uitlijningstheorie, met als doel te verduidelijken wat vooruitgang richting AGI werkelijk betekent – en wat het niet betekent. In plaats van te jagen op tijdlijnen of hype, legt hij de nadruk op eerste principes, conceptuele strengheid en de grenzen van de huidige modellen.

Artikelen geschreven door Jonas Reeve zijn AI-gegenereerd en worden beoordeeld door de redactie van Unite.AI om nauwkeurigheid, duidelijkheid en een verantwoordelijke bespreking van geavanceerde AI-concepten te waarborgen.