نماذج ومنصات الذكاء الاصطناعي
LlamaIndex تُطلق Extract V2.5 مع تحسينات في الدقة والتمثيل

قدمت LlamaIndex Extract v2.5 في 1 أكتوبر 2026، وهي جيل جديد من وكلاء استخراج المستندات القائمين على المخطط. في مقالة مدونة من كتابة أدريان ليجاك وإيلي ستيوارت، أفادت الشركة بتحسينات في الدقة عبر جميع مستويات الاستخراج الثلاثة وتعزيز التمثيل للاثنين الأعلى، Agentic و Agentic Plus، وقالت إن هذه المكاسب لا تصاحب أي زيادة في سعر الصفحة.
تحسينات المعايير حسب المستوى
أفادت LlamaIndex أنه على ExtractBench، معيار استخراج المستندات المفتوح الخاص بها، ارتفعت قيمة F1 الإجمالية من 87.1 إلى 93.9 لفئة Cost Effective، ومن 89.8 إلى 95.8 لفئة Agentic، ومن 95.1 إلى 96.4 لفئة Agentic Plus، وهي الفئة ذات أعلى دقة. ووفقًا للشركة، أصبحت فئة Cost Effective الآن تتفوق على الفئة السابقة Agentic، وتتفوق فئة Agentic على الفئة السابقة Agentic Plus.
ExtractBench يختبر 370 مستندًا مؤسسيًا بإجمالي 4,869 صفحة عبر 8 مجالات أعمال و67 نوعًا من المستندات، كل نوع له مخططه الخاص. نشرت LlamaIndex المعيار مع مجموعة بيانات عامة، وآلية تقييم، ومنهجية، وقد قيمت نماذج VLM المتقدمة، ووكلاء الترميز، وواجهات برمجة تطبيقات الاستخراج المتخصصة عليها.
آلية الوكيل الجديدة والتفكير الهيكلي
قالت الشركة إن v2.5 يعمل على آلية وكيل جديدة مصممة خصيصًا لاستخراج المستندات، مستوحاة من أحدث وكلاء الترميز ومضبوطة حول النماذج للتعامل مع أوضاع الفشل عبر الرؤية والتفكير والتحقق. وأفادت LlamaIndex أن الوكيل الناتج يمكنه الإشارة المتبادلة إلى السياق من صفحات متعددة وتثبيت القيم في المصادر الدقيقة.
تعمل قدرة يُطلق عليها المقال “التفكير الهيكلي” على تمثيلات المستند لتخصيص الاستخراج بناءً على نوع المستند، وتنسيقه، وكثافة المعلومات: يكرس الوكيل جهدًا أكبر للوثائق المعقدة ويعالج الوثائق الأبسط بكمون أقل. بالنسبة إلى v2.5، نقل الفريق آلية Agentic Plus إلى فئتي Cost Effective و Agentic، مع تعديل أدواته واستراتيجيات الاستخراج لتتناسب مع قيود التكلفة لكل فئة بعد تقييم تمثيلات المستندات والأدوات وتكوينات النماذج. كما ذكرت الشركة أنها عملت على كيفية اتباع الوكلاء للمخططات وتعليمات الاستخراج، بما في ذلك المهام التي تصل إلى 3,200 حقل، وتنصح المستخدمين الذين تكون معرفات السجلات ضرورية لمطابقة السجلات المستخرجة مع قاعدة البيانات بذكر ذلك في مطالباتهم.
القوائم الطويلة، السجلات عبر الصفحات، والنماذج الممسوحة ضوئيًا
في مهام القوائم الطويلة، أفادت LlamaIndex بارتفاع الدرجات من 82.0 إلى 92.6 لفئة Cost Effective، ومن 86.1 إلى 95.5 لفئة Agentic، ومن 94.5 إلى 96.3 لفئة Agentic Plus. وقالت الشركة إن v2.5 يستخدم تمثيلات وسيطة للعمل مع مجموعة البيانات الكاملة ويُحقق من صحة مخرجاته مقابل مخطط المستخدم. في مثال واحد، ملف صندوق مكوّن من 17 صفحة، أعادت فئة Cost Effective السابقة 87 من أصل 238 حيازة؛ وأفادت الشركة أن v2.5 تُعيد جميع الـ238، مما رفع درجة استخراج هذا المستند من 52.8 إلى 98.7.
في السجلات التي تمتد عبر صفحات، ارتفعت الدرجات من 80.3 إلى 92.0 لفئة Cost Effective، ومن 85.5 إلى 96.5 لفئة Agentic، ومن 93.6 إلى 96.7 لفئة Agentic Plus. في جدول منح United Way Worldwide Schedule I، قالت الشركة إن Agentic الإصدار 2.0 توقف عند فاصل الصفحة، مما ترك غرض المنحة وعنوانها غير مكتملين، بينما يضم v2.5 الاستمرار من الصفحة التالية في نفس السجل.
في النماذج الممسوحة ضوئيًا، ارتفعت الدرجات من 89.6 إلى 93.9 لفئة Cost Effective، ومن 90.9 إلى 95.7 لفئة Agentic، ومن 94.4 إلى 96.1 لفئة Agentic Plus. في تصريح التخلص W-14 المشروح، ذكرت الشركة أن فئة Agentic كانت تجمع سابقًا تاريخ المراجع مع رقم التصريح وتضيف ملاحظة المراجع إلى عمق المياه العذبة، بينما يقوم v2.5 بفصل القيم الأصلية عن التعليقات إلى الحقول المطلوبة وفق المخطط.
الاستشهادات المتقدمة والتمثيل الدقيق
تقدم هذه الإصدارة الاستشهادات المتقدمة لفئتي Agentic و Agentic Plus، التي تحدد صناديق الحدود للأدلة الداعمة للحقول الصعبة، بما في ذلك القيم التي لا تظهر كلمة بكلمة في المستند. كان الإصدار الأول متاحًا سابقًا في Agentic Plus؛ وقالت LlamaIndex إنه حسّن دقة التمثيل الدقيق لهذه الميزة أكثر ووسعها لتشمل فئة Agentic. أفادت الشركة بأن درجات التمثيل الدقيق على ExtractBench ارتفعت من 46.8 إلى 80.6 لفئة Agentic ومن 46.4 إلى 82.2 لفئة Agentic Plus. وتُظهر مخطط المقارنة درجات التمثيل الدقيق 63.2 لـ Sonnet 5.5، و77.6 لـ GPT-6 SOL، و77.5 لـ Opus 5.5، و50.8 لـ Reducto Deep Extract، و21.8 لـ Extend Max، و54.3 لفئتها Cost Effective.
قالت الشركة إن الاستشهادات بصناديق الحدود تُدمج مع درجات الثقة، مما يساعد الفرق على تحديد القيم المستخرجة التي يمكنها المتابعة تلقائيًا وتلك التي تحتاج إلى فحص أعمق، مما يتيح للمراجعين التحقق من القيم المُعلَّمة مقابل المستند الأصلي في سير عمل بشري في الحلقة.
وضع الجداول الإلكترونية والتوافر
تضيف v2.5 استخراجًا أصليًا للجداول الإلكترونية: في وضع الجداول، يعمل الوكلاء مباشرةً مع خلايا المصنف بدلاً من تمثيل مسطح، ويمكن للمستخدمين تفعيل الوضع في إعدادات الاستخراج.
يتوفر Extract v2.5 عبر LlamaCloud، وأداة سطر الأوامر المبنية على Go تُدعى llp، وخادم MCP لعملاء الوكيل بما في ذلك Claude Code وCodex، وكذلك مجموعة تطوير Python llama-cloud SDK، حيث يمكن لمهام الاستخراج اختيار الإصدار 2.5 وتمكين خيارات citeالمصادر والثقةscores. شجعت LlamaIndex المستخدمين على تشغيل v2.5 على المستندات التي تمثل سير عملهم باستخدام المخططات الحالية، وأعلنت أنها تتوقع أن يكون هذا الإصدار خطوة كبيرة في جودة الاستخراج، خاصةً بالنسبة للمستندات التي كانت تحتاج سابقًا إلى تنظيف يدوي أو لم تكن موثوقة بما يكفي للتنفيذ الآلي.












