Modelli e piattaforme di IA
LlamaIndex lancia OpenDocRouter, un’API unificata per l’analisi dei documenti

LlamaIndex, il 7 ottobre 2026, ha lanciato OpenDocRouter, una piattaforma ospitata per la conversione da documento a markdown che mette un insieme di modelli all’avanguardia e open source dietro un’unica API, ciascuno eseguito con una ricetta di parsing versionata e valutato su ParseBench per qualità e costo.
LlamaIndex ha dichiarato di aver creato il servizio per condividere un lavoro in cui era particolarmente esperto. L’annuncio evidenzia un panorama affollato: una ricerca su HuggingFace per “ocr” restituisce migliaia di modelli, i laboratori all’avanguardia rilasciano modelli capaci di gestire documenti quasi ogni mese, e l’utilizzo di tali modelli richiede generalmente gli stessi pochi passaggi, dalla definizione dei prompt e la gestione dei limiti di velocità alla gestione delle distribuzioni e dei costi correlati, oltre al benchmarking dei nuovi modelli man mano che vengono rilasciati.
La pagina del prodotto presenta OpenDocRouter come un’API unificata per l’analisi dei documenti che converte PDF e immagini in markdown. Le pagine vengono eseguite come chiamate modello individuali man mano che la capacità è disponibile, e ogni pagina restituisce il proprio markdown, lo stato e il costo. Le pagine non riuscite possono essere ritentate singolarmente, e la selezione delle pagine consente a chi chiama di saltare quelle già in possesso.
Gamma di lancio e punteggi ParseBench
Al lancio, l’API offre cinque modelli all’avanguardia (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra e GPT-6 Luna) e cinque modelli open source (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr e PaddleOCR-VL-1.6). LlamaIndex ha dichiarato di aver selezionato il set di lancio per coprire ogni aspetto dei propri benchmark, e che ogni modello è valutato su ParseBench sia in termini di qualità sia di costo.
La pagina dei modelli e dei benchmark riporta i risultati di ParseBench in cinque categorie (Tabelle, Grafici, Fedeltà, Formattazione e Contestualizzazione) e definisce il punteggio Complessivo come la media delle cinque. Claude Opus 5.5 è elencato con un punteggio Complessivo di 84,20, includendo 93,53 su Tabelle e 91,03 su Fedeltà, a $48,82 per 1.000 pagine. GPT-6 Luna è elencato con 71,34 Complessivo e $0,80 per 1.000 pagine, MinerU2.5-Pro a 70,05 e $0,86, e TeleOCR a 57,25 e $2,70. Secondo la pagina, il valore per 1.000 pagine riflette quanto costano 1.000 pagine tipiche ai prezzi attuali, basato sui token che ogni modello utilizza per pagina nei documenti di ParseBench, e le pagine di un utente possono utilizzare più o meno token; i prezzi indicati hanno una data di versione del 6 ottobre 2026.
Ogni ricetta di parsing di un modello ha una versione che cambia ogni volta che il suo output può variare. Nella tabella token-prezzo nella pagina dei modelli, Claude Opus 5.5 e GPT-5.6 Terra riportano una data di versione 25 settembre 2026, mentre GPT-6 Luna riporta 5 ottobre 2026. LlamaIndex ha dichiarato che, quando nuovi modelli vengono rilasciati e possono essere offerti, li sottopone a ParseBench per calibrare prompt, costi e altre impostazioni prima di aggiungerli, e prevede di continuare a migliorare i modelli più popolari tramite prompt migliori e hosting più efficiente per ridurre la latenza.
Meccaniche dell’API e motore di grounding
L’API accetta file PDF, PNG e JPEG, o URL a tali formati, tramite un endpoint POST /v1/parse. Secondo la documentazione API, un documento può essere inviato come URL HTTPS pubblico o come ID di file caricato, ciascuno limitato a 50 MB o 500 pagine, oppure come dati base64 inline fino a circa 3 MB. Le richieste vengono eseguite in modo sincrono per un massimo di 50 pagine; i documenti più grandi vengono elaborati in modo asincrono, fino a 500 pagine con caching obbligatorio, e un campo opzionale pages, ad esempio “1-3,7”, seleziona pagine specifiche. Una risposta contiene uno stato di completed, partial o failed, con markdown per pagina e utilizzo di token.
SDK tipizzati per Python e TypeScript si installano via pip e npm, con il codice sorgente nei repository GitHub run-llama/opendocrouter-py e run-llama/opendocrouter-ts e metodi che rispecchiano gli endpoint, inclusi parse.create, uploads.create, credits.get e models.list.
Poiché i modelli forniscono garanzie diverse riguardo a bounding box e layout (alcuni producono box nativamente, altri richiedono prompt, e alcuni non lo supportano affatto), LlamaIndex ha costruito un motore di grounding che può essere applicato a qualsiasi modello. Impostare layout: true restituisce markdown con bounding box ancorati e elementi di layout in ordine di lettura, sotto un insieme condiviso di classi di layout: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form e key_value. Le coordinate di una box sono frazioni della pagina misurate dal suo angolo superiore sinistro, gli elementi riportano valori di confidenza, e una pagina il cui layout fallisce mantiene il suo markdown senza addebitare il layout.
Per quanto riguarda la conservazione, la documentazione afferma che nulla di un documento viene mantenuto a meno che il caching non sia abilitato; i risultati memorizzati nella cache sono criptati per 24 ore, una chiamata delete li rimuove prima, e successive richieste per le stesse pagine dello stesso documento con lo stesso modello e impostazione di layout vengono servite dalla cache gratuitamente. Il servizio ritenta ogni pagina una volta in caso di timeout, limiti di velocità, errori del provider e capacità, e quando un modello entra in loop o non trascrive. I limiti dell’account includono 10 richieste concorrenti, di cui cinque possono essere asincrone, 300 chiamate parse e 60 chiamate di polling al minuto, un timeout per pagina di 270 secondi e un’attesa fino a 30 minuti per la capacità nelle richieste asincrone.
Prezzi, fatturazione e la distinzione LlamaParse
OpenDocRouter fattura esclusivamente per token. Gli account ricaricano crediti prepagati a partire da $25, con una commissione del 5% su ogni ricarica; i modelli di frontiera vengono addebitati ai prezzi dei token dei loro fornitori senza alcun markup; e l’abilitazione del layout aggiunge $0.20 per milione di token su pagine il cui layout ha successo. Le pagine fallite, memorizzate nella cache e vuote sono gratuite. Per iniziare, una richiesta deve disporre di credito sufficiente a coprire il suo addebito massimo, definito come la tariffa più alta per pagina del modello moltiplicata per il numero di pagine, e tutto ciò che le pagine non hanno utilizzato viene rilasciato al termine della richiesta.
La tabella dei prezzi dell’annuncio, datata 7 ottobre 2026, elenca Claude Opus 5.5 a $4.00 per milione di token di input e $20.00 per milione di token di output, GPT-6 Luna a $0.10 per milione di token di input e $0.50 per milione di token di output, e MinerU2.5-Pro a $0.08 per milione di token di input e $0.39 per milione di token di output.
LlamaIndex traccia una distinzione tra il nuovo servizio e LlamaParse, la sua piattaforma di documenti gestita. Nella visione dell’azienda, OpenDocRouter è una piattaforma per ospitare rapidamente i modelli più recenti, consentendo agli sviluppatori di passare e instradare tra di essi pagando solo per ciò che utilizzano, mentre LlamaParse offre livelli di parsing ottimizzati manualmente, controlli aziendali, distribuzioni self-hosted e API aggiuntive come l’estrazione di schemi e l’indicizzazione.
OpenDocRouter è attivo, e LlamaIndex indirizza gli utenti a esplorare i modelli e la documentazione, registrarsi, generare una chiave API e iniziare il parsing.












