Mô hình và nền tảng AI
LlamaIndex ra mắt OpenDocRouter, một API thống nhất cho việc phân tích tài liệu

LlamaIndex vào ngày 7 tháng 10 năm 2026 ra mắt OpenDocRouter, một nền tảng lưu trữ cho việc chuyển đổi tài liệu sang markdown mà đặt một tập hợp các mô hình tiên tiến và mã nguồn mở phía sau một API duy nhất, mỗi mô hình được chạy theo công thức phân tích có phiên bản và được đánh giá trên ParseBench về chất lượng và chi phí.
LlamaIndex cho biết họ xây dựng dịch vụ này để chia sẻ công việc mà họ đã trở nên đặc biệt giỏi. Thông báo cho thấy một lĩnh vực đông đúc: một tìm kiếm trên HuggingFace với từ khóa “ocr” hiện ra hàng ngàn mô hình, các phòng thí nghiệm tiên tiến liên tục phát hành các mô hình có khả năng xử lý tài liệu gần như mỗi tháng, và việc sử dụng các mô hình này thường đòi hỏi một vài bước giống nhau, từ việc xác định prompt và xử lý giới hạn tốc độ đến quản lý triển khai và chi phí liên quan, cũng như đánh giá các mô hình mới khi chúng ra mắt.
Trang trang chủ sản phẩm giới thiệu OpenDocRouter như một API thống nhất cho việc phân tích tài liệu, chuyển PDF và hình ảnh thành markdown. Các trang được chạy như các lời gọi mô hình riêng biệt khi dung lượng khả dụng, và mỗi trang trả về markdown, trạng thái và chi phí riêng của nó. Các trang thất bại có thể được thử lại riêng lẻ, và việc chọn trang cho phép người gọi bỏ qua các trang đã có.
Danh sách ra mắt và điểm số ParseBench
Khi ra mắt, API cung cấp năm mô hình tiên tiến (Claude Opus 5.5, Gemini 3 Flash, Gemini 3.8 Flash, GPT-5.6 Terra và GPT-6 Luna) và năm mô hình mã nguồn mở (Infinity-Parser2-Flash, MinerU2.5-Pro, TeleOCR, dots.mocr và PaddleOCR-VL-1.6). LlamaIndex cho biết họ đã chọn bộ mô hình ra mắt để bao phủ mọi khía cạnh trong các tiêu chuẩn đánh giá của mình, và mỗi mô hình đều được đánh giá trên ParseBench về cả chất lượng và chi phí.
Trang trang mô hình và tiêu chuẩn báo cáo kết quả ParseBench trong năm danh mục (Bảng, Biểu đồ, Độ trung thực, Định dạng và Định vị), và định nghĩa điểm Tổng thể là trung bình của năm danh mục. Claude Opus 5.5 được liệt kê với điểm Tổng thể 84.20, bao gồm 93.53 trong Bảng và 91.03 trong Độ trung thực, với giá $48.82 cho mỗi 1,000 trang. GPT-6 Luna được liệt kê với điểm Tổng thể 71.34 và $0.80 cho mỗi 1,000 trang, MinerU2.5-Pro với 70.05 và $0.86, và TeleOCR với 57.25 và $2.70. Theo trang này, con số cho mỗi 1,000 trang phản ánh chi phí của 1,000 trang điển hình tại giá hiện tại dựa trên số token mỗi mô hình sử dụng cho mỗi trang trong các tài liệu của ParseBench, và các trang của người dùng có thể tiêu thụ nhiều hoặc ít token hơn; các mức giá được liệt kê có ngày phiên bản là 6 tháng 10, 2026.
Phiên bản công thức phân tích của mỗi mô hình thay đổi mỗi khi đầu ra của nó có thể thay đổi. Trong bảng token‑giá trên trang mô hình, Claude Opus 5.5 và GPT-5.6 Terra có ngày phiên bản 25 tháng 9, 2026, trong khi GPT-6 Luna có ngày 5 tháng 10, 2026. LlamaIndex cho biết khi các mô hình mới được phát hành mà họ có thể cung cấp, họ sẽ chạy chúng qua ParseBench để hiệu chỉnh prompt, chi phí và các cài đặt khác trước khi thêm vào, và họ dự định tiếp tục cải thiện các mô hình phổ biến nhất bằng các prompt tốt hơn và hosting tốt hơn để giảm độ trễ.
Cơ chế API và Động cơ Định vị
API chấp nhận các tệp PDF, PNG và JPEG, hoặc URL tới các định dạng này, thông qua endpoint POST /v1/parse. Theo tài liệu API, một tài liệu có thể được gửi dưới dạng URL HTTPS công cộng hoặc ID tệp đã tải lên, mỗi tài liệu giới hạn tối đa 50 MB hoặc 500 trang, hoặc dưới dạng dữ liệu base64 nội tuyến lên tới khoảng 3 MB. Các yêu cầu chạy đồng bộ cho tối đa 50 trang; tài liệu lớn hơn chạy bất đồng bộ, lên tới 500 trang với yêu cầu bộ nhớ đệm, và trường tùy chọn pages như “1-3,7” cho phép chọn các trang cụ thể. Phản hồi chứa trạng thái hoàn thành, một phần hoặc thất bại, cùng với markdown và lượng token sử dụng cho mỗi trang.
SDK Python và TypeScript có kiểu dữ liệu được cài đặt qua pip và npm, với mã nguồn nằm trong các kho GitHub run-llama/opendocrouter-py và run-llama/opendocrouter-ts và các phương thức phản ánh các endpoint, bao gồm parse.create, uploads.create, credits.get và models.list.
Vì các mô hình đưa ra các cam kết khác nhau về hộp giới hạn và bố cục (một số xuất ra hộp một cách tự nhiên, một số cần prompt, và một số không thể thực hiện), LlamaIndex đã xây dựng một engine định vị mà có thể áp dụng cho bất kỳ mô hình nào. Khi đặt layout: true, kết quả trả về markdown có các hộp giới hạn đã được định vị và các yếu tố bố cục theo thứ tự đọc, dựa trên một tập hợp chung các lớp bố cục: title, section_header, text, list_item, table, picture, chart, formula, caption, footnote, page_header, page_footer, code, form, và key_value. Tọa độ của một hộp là các phần của trang đo từ góc trên‑trái, các yếu tố mang giá trị độ tin cậy, và một trang mà bố cục thất bại sẽ giữ lại markdown mà không tính phí bố cục.
Về việc lưu trữ, tài liệu ghi rõ rằng không có gì từ một tài liệu được giữ lại trừ khi bật bộ nhớ đệm; các kết quả được lưu trong bộ nhớ đệm được mã hóa trong 24 giờ, một lệnh xóa sẽ loại bỏ chúng sớm hơn, và các yêu cầu sau đó cho cùng các trang của cùng một tài liệu với cùng mô hình và cài đặt bố cục sẽ được phục vụ từ bộ nhớ đệm miễn phí. Dịch vụ sẽ thử lại mỗi trang một lần khi gặp thời gian chờ, giới hạn tốc độ, lỗi nhà cung cấp và thiếu dung lượng, cũng như khi một mô hình vòng lặp hoặc không thể chuyển đổi. Giới hạn tài khoản bao gồm 10 yêu cầu đồng thời, trong đó năm có thể là bất đồng bộ, 300 lời gọi parse và 60 lời gọi polling mỗi phút, thời gian chờ tối đa 270 giây cho mỗi trang, và thời gian chờ lên tới 30 phút để có dung lượng cho các yêu cầu bất đồng bộ.
Giá, Thanh toán và Đặc điểm LlamaParse
OpenDocRouter tính phí hoàn toàn dựa trên token. Các tài khoản nạp tiền trước bắt đầu từ $25, với phí 5% cho mỗi lần nạp; các mô hình tiên tiến được tính phí theo giá token của nhà cung cấp mà không có phụ phí; và bật tính năng bố cục sẽ tăng $0.20 cho mỗi triệu token trên các trang mà việc bố cục thành công. Các trang thất bại, đã lưu trong bộ nhớ đệm và trang trống đều miễn phí. Để bắt đầu, một yêu cầu phải có đủ tín dụng để bao phủ chi phí tối đa, được định nghĩa là mức phí cao nhất trên mỗi trang của mô hình nhân với số lượng trang, và bất kỳ token nào không được sử dụng bởi các trang sẽ được trả lại khi yêu cầu kết thúc.
Bảng giá của thông báo, ngày 7 tháng 10, 2026, liệt kê Claude Opus 5.5 với $4.00 cho mỗi triệu token đầu vào và $20.00 cho mỗi triệu token đầu ra, GPT-6 Luna với $0.10 cho mỗi triệu token đầu vào và $0.50 cho mỗi triệu token đầu ra, và MinerU2.5-Pro với $0.08 cho mỗi triệu token đầu vào và $0.39 cho mỗi triệu token đầu ra.
LlamaIndex phân biệt rõ ràng giữa dịch vụ mới và LlamaParse, nền tảng tài liệu được quản lý của mình. Theo cách trình bày của công ty, OpenDocRouter là một nền tảng cho phép nhanh chóng triển khai các mô hình mới nhất, cho phép các nhà phát triển chuyển đổi và định tuyến giữa chúng đồng thời chỉ trả tiền cho những gì họ sử dụng, trong khi LlamaParse cung cấp các cấp độ phân tích được tinh chỉnh thủ công, kiểm soát doanh nghiệp, triển khai tự lưu trữ và các API bổ sung như trích xuất schema và lập chỉ mục.
OpenDocRouter đã hoạt động, và LlamaIndex hướng dẫn người dùng duyệt các mô hình và tài liệu, đăng ký, tạo khóa API, và bắt đầu phân tích.












