Μοντέλα και πλατφόρμες AI

LlamaIndex παρουσιάζει το Extract V2.5 με βελτιώσεις στην ακρίβεια και την εδραιωμένη βάση

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η LlamaIndex παρουσίασε το Extract v2.5 στις 1 οκτωβρίου 2026, μια νέα γενιά των πράκτορων εξαγωγής εγγράφων βάσει σχήματος. Σε ένα άρθρο ιστολογίου με συγγραφείς τους Adrian Lyjak και Eli Stewart, η εταιρεία ανέφερε βελτιώσεις στην ακρίβεια σε όλα τα τρία επίπεδα εξαγωγής της και ενισχυμένη εδραιωμένη βάση για τα δύο υψηλότερα επίπεδα, Agentic και Agentic Plus, και δήλωσε ότι τα κέρδη αυτά δεν συνοδεύονται από αύξηση της τιμολόγησης ανά σελίδα.

Κέρδη Στοιχείων Αναφοράς Κατά Επίπεδο

Η LlamaIndex ανέφερε ότι στο ExtractBench, το ανοιχτό benchmark εξαγωγής εγγράφων, η συνολική τιμή F1 αυξήθηκε από 87,1 σε 93,9 για το επίπεδο Cost Effective, από 89,8 σε 95,8 για το Agentic και από 95,1 σε 96,4 για το Agentic Plus, το υψηλότερο επίπεδο ακρίβειας. Σύμφωνα με την εταιρεία, το Cost Effective ξεπερνά πλέον το προηγούμενο επίπεδο Agentic, ενώ το Agentic ξεπερνά το προηγούμενο Agentic Plus.

ExtractBench δοκιμάζει 370 επιχειρηματικά έγγραφα συνολικού όγκου 4 869 σελίδων σε 8 επιχειρηματικούς τομείς και 67 τύπους εγγράφων, κάθε τύπος με το δικό του σχήμα. Η LlamaIndex δημοσίευσε το benchmark με δημόσιο σύνολο δεδομένων, πλαίσιο αξιολόγησης και μεθοδολογία, και έχει αξιολογήσει κορυφαία VLM, πράκτορες κώδικα και εξειδικευμένα API εξαγωγής σε αυτό.

Νέο Πλαίσιο Πράκτορα και Δομική Λογική

Η εταιρεία δήλωσε ότι το v2.5 λειτουργεί σε νέο πλαίσιο πράκτορα σχεδιασμένο ειδικά για εξαγωγή εγγράφων, αντλώντας έμπνευση από τους πιο πρόσφατους πράκτορες κώδικα και ρυθμισμένο γύρω από τα μοντέλα για να αντιμετωπίζει σφάλματα σε όραση, λογική και επαλήθευση. Η LlamaIndex πρόσθεσε ότι ο resulting πράκτορας μπορεί να διασταυρώνει το περιεχόμενο από πολλαπλές σελίδες και να εδραιώνει τις τιμές σε ακριβείς πηγές.

Μια δυνατότητα που το άρθρο ονομάζει Δομική Λογική λειτουργεί πάνω σε αναπαραστάσεις εγγράφων για να προσαρμόζει την εξαγωγή βάσει τύπου εγγράφου, διάταξης και πυκνότητας πληροφοριών: ο πράκτορας αφιερώνει περισσότερη προσπάθεια σε σύνθετα έγγραφα και επεξεργάζεται τα απλούστερα με χαμηλότερη καθυστέρηση. Για το v2.5, η ομάδα μετέφερε το πλαίσιο πίσω από το Agentic Plus στα επίπεδα Cost Effective και Agentic, προσαρμόζοντας τα εργαλεία και τις στρατηγικές εξαγωγής στις οικονομικές περιορισμούς κάθε επιπέδου μετά την αξιολόγηση των αναπαραστάσεων εγγράφων, των εργαλείων και των ρυθμίσεων μοντέλων. Η εταιρεία επίσης ανέφερε ότι εργάστηκε στον τρόπο με τον οποίο οι πράκτορες ακολουθούν σχήματα και οδηγίες εξαγωγής, συμπεριλαμβανομένων εργασιών με έως 3 200 πεδία, και συμβουλεύει τους χρήστες των οποίων τα IDs εγγραφών είναι κρίσιμα για την αντιστοίχιση των εξαγόμενων εγγραφών με μια βάση δεδομένων να το επισημαίνουν στα prompts τους.

Μακροσκελείς Λίστες, Εγγραφές Πολλαπλών Σελίδων και Σαρωμένες Φόρμες

Σε εργασίες μακροσκελών λιστών, η LlamaIndex ανέφερε ότι οι βαθμολογίες αυξήθηκαν από 82,0 σε 92,6 για το Cost Effective, από 86,1 σε 95,5 για το Agentic και από 94,5 σε 96,3 για το Agentic Plus. Η εταιρεία δήλωσε ότι το v2.5 χρησιμοποιεί ενδιάμεσες αναπαραστάσεις για να εργάζεται με το πλήρες σύνολο δεδομένων και επικυρώνει την έξοδό του έναντι του σχήματος του χρήστη. Σε ένα παράδειγμα, μια 17‑σελιδη υποβολή κεφαλαίου, το προηγούμενο επίπεδο Cost Effective επέστρεφε 87 από 238 συμμετοχές· η εταιρεία ανέφερε ότι το v2.5 επιστρέφει και τις 238, ανεβάζοντας τη βαθμολογία εξαγωγής του εγγράφου από 52,8 σε 98,7.

Σε εγγραφές που εκτείνονται σε πολλές σελίδες, οι αναφερόμενες βαθμολογίες αυξάνονται από 80,3 σε 92,0 για το Cost Effective, από 85,5 σε 96,5 για το Agentic και από 93,6 σε 96,7 για το Agentic Plus. Σε ένα χρονοδιάγραμμα επιδότησης Schedule I του United Way Worldwide, η εταιρεία δήλωσε ότι το Agentic v2.0 σταματούσε σε ένα διαχωριστικό σελίδας, αφήνοντας το σκοπό και τη διεύθυνση της επιδότησης ατελή, ενώ το v2.5 περιλαμβάνει τη συνέχεια από την επόμενη σελίδα στην ίδια εγγραφή.

Σε σαρωμένες φόρμες, οι βαθμολογίες αυξάνονται από 89,6 σε 93,9 για το Cost Effective, από 90,9 σε 95,7 για το Agentic και από 94,4 σε 96,1 για το Agentic Plus. Σε μια σχολιασμένη άδεια διάθεσης W‑14, η εταιρεία ανέφερε ότι το επίπεδο Agentic συνδύαζε προηγουμένως την ημερομηνία του ελεγκτή με τον αριθμό της άδειας και προσάρμοζε μια σημείωση ελεγκτή στο βάθος γλυκού νερού, ενώ το v2.5 διαχωρίζει τις αρχικές τιμές από τις σημειώσεις στα πεδία που ζητά το σχήμα.

Προηγμένες Αναφορές και Εδραιωμένη Βάση

Η έκδοση εισάγει Προηγμένες Αναφορές για τα επίπεδα Agentic και Agentic Plus, οι οποίες εντοπίζουν τα πλαίσια περιορισμού αποδεικτικών στοιχείων για δύσκολα πεδία, συμπεριλαμβανομένων τιμών που δεν εμφανίζονται λέξη‑προς‑λέξη στο έγγραφο. Μια αρχική έκδοση ήταν διαθέσιμη προηγουμένως στο Agentic Plus· η LlamaIndex δήλωσε ότι βελτίωσε περαιτέρω την ακρίβεια εδράσεως της δυνατότητας και την επέκτεινε στο Agentic. Η εταιρεία ανέφερε ότι οι βαθμολογίες εδράσεως στο ExtractBench αυξήθηκαν από 46,8 σε 80,6 για το Agentic και από 46,4 σε 82,2 για το Agentic Plus. Το συγκριτικό διάγραμμα της εταιρείας παραθέτει βαθμολογίες εδράσεως 63,2 για το Sonnet 5.5, 77,6 για το GPT‑6 SOL, 77,5 για το Opus 5.5, 50,8 για το Reducto Deep Extract, 21,8 για το Extend Max και 54,3 για το δικό της επίπεδο Cost Effective.

Η εταιρεία δήλωσε ότι οι αναφορές με πλαίσια περιορισμού συνδυάζονται με βαθμολογίες εμπιστοσύνης, οι οποίες βοηθούν τις ομάδες να αποφασίζουν ποιες εξαγόμενες τιμές μπορούν να προχωρήσουν αυτόματα και ποιες χρειάζονται πιο προσεκτική εξέταση, επιτρέποντας στους ελεγκτές να ελέγχουν τις επισημασμένες τιμές έναντι του αρχικού εγγράφου σε ροές εργασίας με ανθρώπινη παρέμβαση.

Λειτουργία Φύλλων Υπολογισμού και Διαθεσιμότητα

Το v2.5 προσθέτει εγγενή εξαγωγή φύλλων υπολογισμού: στη λειτουργία φύλλου υπολογισμού, οι πράκτορες εργάζονται απευθείας με τα κελιά του βιβλίου εργασίας αντί για μια επίπεδη αναπαράσταση, και οι χρήστες μπορούν να ενεργοποιήσουν τη λειτουργία στη διαμόρφωση εξαγωγής.

Το Extract v2.5 είναι διαθέσιμο μέσω του LlamaCloud, ενός εργαλείου γραμμής εντολών βασισμένου σε Go που ονομάζεται llp, ενός διακομιστή MCP για πελάτες πρακτόρων που περιλαμβάνουν τα Claude Code και Codex, και του Python llama-cloud SDK, όπου οι εργασίες εξαγωγής επιλέγουν την έκδοση 2.5 και μπορούν να ενεργοποιήσουν τις επιλογές παραπομπής πηγών και εμπιστοσύνης βαθμών. Το LlamaIndex ενθάρρυνε τους χρήστες να εκτελούν το v2.5 σε έγγραφα που αντιπροσωπεύουν τις ροές εργασίας τους, χρησιμοποιώντας τα υπάρχοντα σχήματά τους, και δήλωσε ότι αναμένει ότι η έκδοση θα αποτελέσει σημαντική βελτίωση στην ποιότητα εξαγωγής, ιδιαίτερα για έγγραφα που προηγουμένως απαιτούσαν χειροκίνητο καθαρισμό ή δεν ήταν αρκετά αξιόπιστα για αυτοματοποίηση.

Jonas Reeve είναι ένας αναλυτής που δημιουργείται από AI στην Unite.AI, εστιάζοντας στην γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τα θεωρητικά θεμέλια της μηχανικής νοημοσύνης. Η δουλειά του διερευνά πώς η μάθηση, η λογική, η μνήμη και η αφαίρεση εμφανίζονται τόσο σε βιολογικά όσο και σε τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ των σύγχρονων αρχιτεκτονικών AI και των μακροχρόνιων ερωτήσεων στην γνωστική επιστήμη και τη φιλοσοφία του νου.

Με μια εννοιολογική και στοχαστική προσέγγιση, ο Jonas εξετάζει πλαίσια όπως μοντέλα λογικής, συστήματα πράκτορα, αναδυόμενη γνωστική λειτουργία και θεωρία ευθυγράμμισης, με στόχο να διευκρινίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI — και τι δεν σημαίνει. Αντί να κυνηγά χρονοδιαγράμματα ή υπερβολές, δίνει έμφαση στις πρώτες αρχές, στην εννοιολογική αυστηρότητα και στα όρια των τρεχουσών μοντέλων.

Τα άρθρα που συντάσσει ο Jonas Reeve δημιουργούνται από AI και ελέγχονται από την ομάδα συντακτών της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση των προχωρημένων εννοιών AI.