Modelos y plataformas de IA
LlamaIndex lanza OpenDocRouter, una API unificada para el análisis de documentos

LlamaIndex, el 7 de octubre de 2026, lanzó OpenDocRouter, una plataforma alojada para el análisis de documentos a markdown que coloca un conjunto de modelos de vanguardia y de código abierto detrás de una única API, cada uno ejecutado bajo una receta de análisis versionada y evaluado en ParseBench por calidad y costo.
LlamaIndex dijo que construyó el servicio para compartir trabajo en el que se había vuelto particularmente competente. El anuncio apunta a un campo saturado: una búsqueda en HuggingFace de “ocr” muestra miles de modelos, los laboratorios de vanguardia están lanzando modelos con capacidad de documentos casi cada mes, y usar esos modelos suele requerir los mismos pasos, desde definir los prompts y manejar los límites de velocidad hasta gestionar despliegues y costos relacionados y evaluar nuevos modelos a medida que aparecen.
La página principal del producto presenta OpenDocRouter como una API unificada para el análisis de documentos que convierte PDFs e imágenes en markdown. Las páginas se ejecutan como llamadas individuales a modelos a medida que la capacidad está disponible, y cada página devuelve su propio markdown, estado y cargo. Las páginas fallidas pueden reintentarse por separado, y la selección de páginas permite a quien llama omitir las que ya posee.
Línea de lanzamiento y puntuaciones de ParseBench
En el lanzamiento, la API ofrece cinco modelos de vanguardia (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra y GPT-6 Luna) y cinco modelos de código abierto (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr y PaddleOCR-VL-1.6). LlamaIndex dijo que seleccionó el conjunto de lanzamiento para cubrir todos los rincones de sus benchmarks, y que cada modelo está evaluado en ParseBench tanto en calidad como en costo.
La página de modelos y benchmarks informa los resultados de ParseBench en cinco categorías (Tablas, Gráficos, Fidelidad, Formato y Fundamentación) y define la puntuación General como la media de las cinco. Claude Opus 5.5 aparece con una puntuación General de 84.20, incluyendo 93.53 en Tablas y 91.03 en Fidelidad, a $48.82 por 1,000 páginas. GPT-6 Luna aparece con 71.34 General y $0.80 por 1,000 páginas, MinerU2.5-Pro con 70.05 y $0.86, y TeleOCR con 57.25 y $2.70. Según la página, la cifra por 1,000 páginas refleja lo que costarían 1,000 páginas típicas a precios actuales basados en los tokens que cada modelo utilizó por página en los documentos de ParseBench, y las páginas de un usuario pueden usar más o menos tokens; los precios listados llevan una fecha de versión del 6 de octubre de 2026.
Cada receta de análisis de modelo lleva una versión que cambia siempre que su salida pueda variar. En la tabla de precios por token de la página de modelos, Claude Opus 5.5 y GPT-5.6 Terra tienen una fecha de versión del 25 de septiembre de 2026, mientras que GPT-6 Luna tiene el 5 de octubre de 2026. LlamaIndex dijo que cuando se envían nuevos modelos que puede ofrecer, los somete a ParseBench para calibrar prompts, costos y otras configuraciones antes de incorporarlos, y planea seguir mejorando los modelos más populares mediante mejores prompts y un alojamiento más eficiente para reducir la latencia.
Mecánica de la API y el motor de grounding
La API acepta archivos PDF, PNG y JPEG, o URLs a esos formatos, mediante un endpoint POST /v1/parse. Según la documentación de la API, un documento puede enviarse como una URL HTTPS pública o como un ID de archivo subido, cada uno limitado a 50 MB o 500 páginas, o como datos base64 en línea de hasta aproximadamente 3 MB. Las solicitudes se ejecutan de forma sincrónica para hasta 50 páginas; los documentos más extensos se procesan de forma asíncrona, hasta 500 páginas con caché obligatoria, y un campo opcional de páginas como “1-3,7” selecciona páginas específicas. Una respuesta lleva un estado de completado, parcial o fallido, con markdown por página y uso de tokens.
Los SDKs tipados para Python y TypeScript se instalan vía pip y npm, con el código fuente en los repositorios de GitHub run-llama/opendocrouter-py y run-llama/opendocrouter-ts y métodos que replican los endpoints, incluidos parse.create, uploads.create, credits.get y models.list.
Debido a que los modelos ofrecen diferentes garantías sobre cajas delimitadoras y diseño (algunos generan cajas de forma nativa, otros requieren prompts y algunos no pueden hacerlo en absoluto), LlamaIndex construyó un motor de grounding que puede aplicar a cualquier modelo. Establecer layout: true devuelve markdown con cajas delimitadoras fundamentadas y elementos de diseño en orden de lectura, bajo un conjunto compartido de clases de diseño: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form y key_value. Las coordenadas de una caja son fracciones de la página medidas desde su esquina superior izquierda, los elementos llevan valores de confianza, y una página cuyo diseño falla conserva su markdown sin cargo de diseño.
En cuanto a la retención, la documentación indica que nada de un documento se conserva a menos que la caché esté habilitada; los resultados en caché se almacenan cifrados durante 24 horas, una llamada de eliminación los elimina antes, y solicitudes posteriores para las mismas páginas del mismo documento con el mismo modelo y configuración de diseño se sirven desde la caché de forma gratuita. El servicio reintenta cada página una vez ante tiempos de espera, límites de velocidad, errores del proveedor y capacidad, y cuando un modelo entra en bucle o no transcribe. Los límites de cuenta incluyen 10 solicitudes concurrentes, de las cuales cinco pueden ser asíncronas, 300 llamadas de parseo y 60 llamadas de sondeo por minuto, un tiempo de espera de 270 segundos por página, y una espera de hasta 30 minutos para la capacidad en solicitudes asíncronas.
Precios, facturación y la distinción LlamaParse
OpenDocRouter factura exclusivamente por token. Las cuentas recargan créditos prepagados a partir de $25, con una tarifa del 5 % en cada recarga; los modelos de frontera se cobran a los precios de token de sus proveedores sin margen adicional; y habilitar el diseño añade $0,20 por millón de tokens en páginas cuyo diseño se completa con éxito. Las páginas fallidas, en caché y en blanco son gratuitas. Para comenzar, una solicitud debe disponer de crédito suficiente para cubrir su cargo máximo, definido como la tarifa más alta por página del modelo multiplicada por el número de páginas, y lo que las páginas no hayan utilizado se libera al finalizar la solicitud.
La tabla de precios del anuncio, con fecha 7 de octubre de 2026, muestra a Claude Opus 5.5 a $4,00 por millón de tokens de entrada y $20,00 por millón de tokens de salida, GPT-6 Luna a $0,10 por millón de entrada y $0,50 por millón de salida, y MinerU2.5-Pro a $0,08 por millón de entrada y $0,39 por millón de salida.
LlamaIndex traza una diferencia entre el nuevo servicio y LlamaParse, su plataforma de documentos gestionada. Según la empresa, OpenDocRouter es una plataforma para alojar rápidamente los últimos modelos, permitiendo a los desarrolladores cambiar y enrutar entre ellos pagando solo por lo que utilizan, mientras que LlamaParse se entrega con niveles de análisis afinados manualmente, controles empresariales, implementaciones auto‑alojadas y APIs adicionales como extracción de esquemas e indexación.
OpenDocRouter está disponible, y LlamaIndex dirige a los usuarios a explorar los modelos y la documentación, registrarse, generar una clave API y comenzar a analizar.












