Модели и платформы ИИ

LlamaIndex запускает OpenDocRouter, единый API для разбора документов

mm
Добавьте Unite.AI в избранные источники в Google

LlamaIndex on 7 октября 2026 запустила OpenDocRouter, хостинговая платформа для преобразования документов в markdown, которая размещает набор передовых и открытых моделей за единым API, каждая работает по версионированному рецепту разбора и оценивается в ParseBench по качеству и стоимости.

LlamaIndex заявила, что создала сервис, чтобы поделиться работой, в которой она достигла особенно высокого уровня. Объявление указывает на перенасыщенный рынок: поиск по запросу «ocr» на HuggingFace выдаёт тысячи моделей, передовые лаборатории почти каждый месяц выпускают модели, способные работать с документами, а их использование обычно требует одних и тех же нескольких шагов — от разработки подсказок и управления ограничениями скорости до организации развертываний, сопутствующих расходов и оценки новых моделей по мере их появления.

главная страница продукта представляет OpenDocRouter как унифицированный API для разборки документов, который преобразует PDF и изображения в markdown. Страницы обрабатываются как отдельные вызовы модели по мере доступности мощности, и каждая страница возвращает свой собственный markdown, статус и стоимость. Неудачные страницы можно повторно обработать самостоятельно, а выбор страниц позволяет вызывающему пропустить страницы, которые он уже имеет.

Линейка запуска и оценки ParseBench

При запуске API предлагает пять передовых моделей (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra и GPT-6 Luna) и пять открытых моделей (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr и PaddleOCR-VL-1.6). LlamaIndex заявила, что выбрала набор запуска, чтобы охватить каждый уголок своих бенчмарков, и что каждая модель тестируется на ParseBench как по качеству, так и по стоимости.

страница моделей и бенчмарков сообщает результаты ParseBench в пяти категориях (Таблицы, Диаграммы, Верность, Форматирование и Корректность) и определяет общий балл как среднее значение пяти. Claude Opus 5.5 указан с общим баллом 84,20, включая 93,53 по Таблицам и 91,03 по Верности, по цене $48,82 за 1 000 страниц. GPT-6 Luna указан с общим баллом 71,34 и $0,80 за 1 000 страниц, MinerU2.5-Pro — 70,05 и $0,86, а TeleOCR — 57,25 и $2,70. По данным страницы, показатель за 1 000 страниц отражает стоимость 1 000 типичных страниц по текущим ценам, основанным на токенах, использованных каждой моделью на странице в документах ParseBench, а страницы пользователя могут использовать больше или меньше токенов; указанные цены имеют дату версии 6 октября 2026 года.

Каждый рецепт разборки модели имеет версию, которая меняется каждый раз, когда может измениться её вывод. В таблице цен за токены на странице моделей Claude Opus 5.5 и GPT-5.6 Terra имеют дату версии 25 сентября 2026 года, тогда как GPT-6 Luna — 5 октября 2026 года. LlamaIndex заявила, что когда новые модели, которые она может предложить, поступают в сервис, она проходит их через ParseBench для калибровки подсказок, стоимости и других настроек перед добавлением, и планирует продолжать улучшать самые популярные модели за счёт лучших подсказок и лучшего хостинга для снижения задержки.

Механика API и движок привязки

API принимает файлы PDF, PNG и JPEG, либо URL-адреса этих форматов, через POST /v1/parse. Согласно документации API, документ можно отправить как публичный HTTPS‑URL или ID загруженного файла, каждый из которых ограничен 50 МБ или 500 страниц, либо как встроенные данные base64 до примерно 3 МБ. Запросы выполняются синхронно до 50 страниц; более крупные документы обрабатываются асинхронно, до 500 страниц с обязательным кэшированием, и необязательное поле pages, например «1-3,7», выбирает конкретные страницы. Ответ содержит статус завершён, частичный или неудачный, с markdown и использованием токенов на страницу.

Typed Python и TypeScript SDK устанавливаются через pip и npm, с исходным кодом в репозиториях GitHub run-llama/opendocrouter-py и run-llama/opendocrouter-ts, а методы зеркалируют конечные точки, включая parse.create, uploads.create, credits.get и models.list.

Поскольку модели дают разные гарантии относительно ограничивающих рамок и макета (некоторые выводят рамки напрямую, некоторые требуют подсказки, а некоторые не могут этого сделать вовсе), LlamaIndex создала механизм привязки, который можно применить к любой модели. Установка layout: true возвращает markdown с привязанными ограничивающими рамками и элементами макета в порядке чтения, под общим набором классов макета: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form и key_value. Координаты рамки выражены как доли страницы, измеренные от её левого верхнего угла, элементы имеют значения уверенности, а страница, у которой макет не удалось, сохраняет свой markdown без платы за макет.

В части хранения документация указывает, что ничего из документа не сохраняется, если кэширование не включено; кэшированные результаты хранятся в зашифрованном виде в течение 24 часов, вызов delete удаляет их раньше, а последующие запросы к тем же страницам того же документа с той же моделью и настройкой макета обслуживаются бесплатно из кэша. Сервис повторяет каждый запрос к странице один раз при тайм‑ауте, лимитах скорости, ошибках поставщика и нехватке мощности, а также когда модель зацикливается или не транскрибирует. Ограничения аккаунта включают 10 одновременных запросов, из которых пять могут быть асинхронными, 300 вызовов parse и 60 вызовов polling в минуту, тайм‑аут на страницу 270 секунд и ожидание до 30 минут для получения мощности при асинхронных запросах.

Ценообразование, биллинг и отличие LlamaParse

OpenDocRouter взимает плату исключительно за токен. Пользователи пополняют предоплаченные кредиты, начиная с $25, с комиссией 5% за каждое пополнение; передовые модели тарифицируются по ценам токенов их провайдеров без наценки; включение разметки добавляет $0.20 за миллион токенов на страницах, где разметка успешна. Неудачные, кэшированные и пустые страницы бесплатны. Чтобы начать, запрос должен иметь достаточно кредита, покрывающего его максимальную стоимость, определяемую как самая высокая ставка модели за страницу, умноженная на количество страниц, а неиспользованные токены страниц освобождаются после завершения запроса.

В таблице цен, опубликованной 7 октября 2026, указаны Claude Opus 5.5 — $4.00 за миллион входных токенов и $20.00 за миллион токенов вывода, GPT-6 Luna — $0.10 за миллион входных токенов и $0.50 за миллион токенов вывода, MinerU2.5-Pro — $0.08 за миллион входных токенов и $0.39 за миллион токенов вывода.

LlamaIndex проводит различие между новым сервисом и LlamaParse, своей управляемой платформой для работы с документами. По мнению компании, OpenDocRouter — это платформа для быстрого размещения новейших моделей, позволяющая разработчикам переключаться и направлять запросы между ними, платя только за фактическое использование, тогда как LlamaParse поставляется с вручную настроенными уровнями парсинга, корпоративными контролями, самостоятельными развертываниями и дополнительными API, такими как извлечение схем и индексация.

OpenDocRouter уже доступен, и LlamaIndex направляет пользователей просматривать модели и документацию, регистрироваться, генерировать API‑ключ и начинать парсинг.

Jonas Reeve является исследовательским ИИ-агентом, созданным ИИ, в Unite.AI, специализирующимся на когнитивном ИИ, искусственном общем интеллекте (AGI) и теоретических основах машинного интеллекта. Его работа исследует, как обучение, рассуждение, память и абстракция возникают как в биологических, так и в искусственных системах, устанавливая связи между современными архитектурами ИИ и давними вопросами когнитивной науки и философии разума.

Подходя концептуально и рефлексивно, Jonas исследует такие рамки, как модели рассуждения, агентные системы, возникшее познание и теория выравнивания, стремясь прояснить, что на самом деле означает прогресс в направлении AGI — и чего он не означает. Вместо того чтобы гнаться за сроками или ажиотажем, он подчеркивает фундаментальные принципы, концептуальную строгость и ограничения текущих моделей.

Статьи, написанные Jonas Reeve, генерируются ИИ и проверяются редакционной командой Unite.AI, чтобы обеспечить точность, ясность и ответственное обсуждение передовых концепций ИИ.