Modelos e plataformas de IA
LlamaIndex lança OpenDocRouter, uma API unificada para análise de documentos

LlamaIndex, em 7 de outubro de 2026, lançou o OpenDocRouter, uma plataforma hospedada para conversão de documentos em markdown que coloca um conjunto de modelos de ponta e de código aberto atrás de uma única API, cada um executado sob uma receita de análise versionada e avaliado no ParseBench quanto à qualidade e ao custo.
A LlamaIndex afirmou que desenvolveu o serviço para compartilhar trabalhos nos quais se tornou particularmente competente. O anúncio aponta para um campo saturado: uma busca no HuggingFace por “ocr” traz milhares de modelos, laboratórios de ponta lançam modelos capazes de processar documentos quase todo mês, e usar esses modelos geralmente exige os mesmos poucos passos, desde definir prompts e lidar com limites de taxa até gerenciar implantações e custos associados e avaliar novos modelos à medida que são lançados.
A página inicial do produto apresenta o OpenDocRouter como uma API unificada para análise de documentos que converte PDFs e imagens em markdown. As páginas são processadas como chamadas individuais de modelo à medida que a capacidade se torna disponível, e cada página devolve seu próprio markdown, status e cobrança. Páginas que falham podem ser reprocessadas individualmente, e a seleção de páginas permite que o chamador ignore páginas que já possui.
Conjunto de Lançamento e Pontuações do ParseBench
No lançamento, a API oferece cinco modelos de ponta (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra e GPT-6 Luna) e cinco modelos de código aberto (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr e PaddleOCR-VL-1.6). A LlamaIndex afirmou que selecionou o conjunto de lançamento para cobrir todos os aspectos de seus benchmarks, e que cada modelo é avaliado no ParseBench tanto em qualidade quanto em custo.
A página de modelos e benchmarks apresenta os resultados do ParseBench em cinco categorias (Tabelas, Gráficos, Fidelidade, Formatação e Fundamentação) e define a pontuação Geral como a média das cinco. Claude Opus 5.5 aparece com pontuação Geral de 84,20, incluindo 93,53 em Tabelas e 91,03 em Fidelidade, a $48,82 por 1.000 páginas. GPT-6 Luna tem pontuação Geral de 71,34 e $0,80 por 1.000 páginas, MinerU2.5-Pro 70,05 e $0,86, e TeleOCR 57,25 e $2,70. Segundo a página, o valor por 1.000 páginas reflete o custo de 1.000 páginas típicas nos preços atuais, com base nos tokens que cada modelo usou por página nos documentos do ParseBench, e as páginas de um usuário podem usar mais ou menos tokens; os preços listados têm data de versão de 6 de outubro de 2026.
A receita de análise de cada modelo possui uma versão que muda sempre que sua saída pode mudar. Na tabela de token-preço na página de modelos, Claude Opus 5.5 e GPT-5.6 Terra apresentam data de versão de 25 de setembro de 2026, enquanto GPT-6 Luna tem data de 5 de outubro de 2026. A LlamaIndex afirmou que, quando novos modelos que pode oferecer são lançados, eles são submetidos ao ParseBench para calibrar prompts, custos e outras configurações antes de serem adicionados, e planeja continuar aprimorando os modelos mais populares por meio de prompts melhores e hospedagem aprimorada para reduzir a latência.
Mecânica da API e o Motor de Fundamentação
A API aceita arquivos PDF, PNG e JPEG, ou URLs para esses formatos, por meio de um endpoint POST /v1/parse. Conforme a documentação da API, um documento pode ser enviado como URL HTTPS pública ou como ID de arquivo enviado, cada um limitado a 50 MB ou 500 páginas, ou como dados base64 embutidos de até cerca de 3 MB. As solicitações são executadas de forma síncrona para até 50 páginas; documentos maiores são processados de forma assíncrona, até 500 páginas com cache obrigatório, e um campo opcional de páginas, como “1-3,7”, seleciona páginas específicas. Uma resposta contém um status de concluído, parcial ou falhado, com markdown e uso de tokens por página.
SDKs tipados para Python e TypeScript são instalados via pip e npm, com o código-fonte nos repositórios GitHub run-llama/opendocrouter-py e run-llama/opendocrouter-ts, e métodos que replicam os endpoints, incluindo parse.create, uploads.create, credits.get e models.list.
Como os modelos oferecem garantias diferentes sobre caixas delimitadoras e layout (alguns geram caixas nativamente, outros precisam de prompts e alguns não conseguem fazê-lo), a LlamaIndex desenvolveu um motor de fundamentação que pode ser aplicado a qualquer modelo. Definir layout: true devolve markdown com caixas delimitadoras fundamentadas e elementos de layout em ordem de leitura, sob um conjunto compartilhado de classes de layout: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form e key_value. As coordenadas de uma caixa são frações da página medidas a partir do canto superior esquerdo, os elementos carregam valores de confiança, e uma página cujo layout falha mantém seu markdown sem cobrança de layout.
Quanto à retenção, a documentação afirma que nada de um documento é mantido a menos que o cache esteja habilitado; os resultados em cache são armazenados criptografados por 24 horas, uma chamada de exclusão os remove antes, e solicitações posteriores para as mesmas páginas do mesmo documento com o mesmo modelo e configuração de layout são atendidas gratuitamente a partir do cache. O serviço tenta novamente cada página uma vez em caso de timeouts, limites de taxa, erros do provedor e falta de capacidade, e quando um modelo entra em loop ou não transcreve. Os limites de conta incluem 10 solicitações simultâneas, das quais cinco podem ser assíncronas, 300 chamadas de parse e 60 chamadas de polling por minuto, timeout de 270 segundos por página e espera de até 30 minutos por capacidade em solicitações assíncronas.
Preços, Faturamento e a Distinção LlamaParse
OpenDocRouter cobra exclusivamente por token. As contas recarregam créditos pré-pagos a partir de US$ 25, com uma taxa de 5 % em cada recarga; modelos de fronteira são cobrados ao preço de token de seus provedores, sem margem adicional; e habilitar layout adiciona US$ 0,20 por milhão de tokens em páginas cujo layout é bem‑sucedido. Páginas falhadas, em cache e em branco são gratuitas. Para iniciar, uma solicitação deve possuir crédito suficiente para cobrir sua cobrança máxima, definida como a taxa mais alta por página do modelo multiplicada pelo número de páginas, e o que as páginas não utilizarem é liberado ao término da solicitação.
A tabela de preços do anúncio, datada de 7 de outubro de 2026, lista Claude Opus 5.5 a US$ 4,00 por milhão de tokens de entrada e US$ 20,00 por milhão de tokens de saída, GPT-6 Luna a US$ 0,10 por milhão de entrada e US$ 0,50 por milhão de saída, e MinerU2.5-Pro a US$ 0,08 por milhão de entrada e US$ 0,39 por milhão de saída.
LlamaIndex traça uma distinção entre o novo serviço e o LlamaParse, sua plataforma de documentos gerenciada. Na perspectiva da empresa, o OpenDocRouter é uma plataforma para hospedar rapidamente os modelos mais recentes, permitindo que desenvolvedores alternem e roteiem entre eles pagando apenas pelo que utilizam, enquanto o LlamaParse oferece camadas de análise afinadas manualmente, controles corporativos, implantações auto‑hospedadas e APIs adicionais, como extração de esquemas e indexação.
O OpenDocRouter está ativo, e a LlamaIndex orienta os usuários a explorar os modelos e a documentação, cadastrar‑se, gerar uma chave de API e iniciar a análise.












