Μοντέλα και πλατφόρμες AI

Η Anthropic Επαναρυθμίζει τις Βιολογικές Προστασίες του Fable 5, Μειώνοντας τις Αποκλεισμένες Ερωτήσεις κατά 85%

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Anthropic στις 7 Αυγούστου 2026 κυκλοφόρησε μια ενημέρωση για τις βιολογικές προστασίες στο Claude Fable 5, η οποία, όπως αναφέρει η εταιρεία, μειώνει τις βιολογικά σχετικές “πτώσεις” κατά περίπου 85% σε δοκιμές σε όλες τις επιφάνειες του προϊόντος — τις αυτόματες ανακατευθύνσεις που στέλνουν την ερώτηση του χρήστη σε ένα λιγότερο ικανό μοντέλο όταν το σύστημα κρίνει ότι η αίτηση αφορά προστατευμένο βιολογικό έδαφος.

Στην ανακοίνωσή της, η Anthropic ανέφερε ότι οι χρήστες πρέπει τώρα να δουν πολύ λιγότερες πτώσεις στις καθημερινές ερωτήσεις υγείας και εκπαίδευσης, όπως η ερμηνεία αποτελεσμάτων εργαστηριακών εξετάσεων, η κατανόηση συμπτωμάτων και η μάθηση βιολογίας σε εκπαιδευτικό περιβάλλον, και ότι οι επαγγελματίες υγείας πρέπει να λάβουν περισσότερη υποστήριξη στις κλινικές εργασίες. Η μείωση των βιολογικών πτώσεων αναμένεται να μειώσει τον συνολικό όγκο πτώσεων περίπου κατά 67% στο Claude.ai, 55% στο Cowork, 17% στο Claude Code και 7% στη πλατφόρμα Claude, σύμφωνα με μια υποσημείωση στην ανάρτηση.

Η εταιρεία είναι σαφής ότι η ενημέρωση δεν ανοίγει το μοντέλο στην επαγγελματική βιολογική έρευνα. Το Fable 5 εξακολουθεί να πιάνει πίσω στο Claude Opus 5 για αιτήσεις που η Anthropic θεωρεί διπλού σκοπού, συμπεριλαμβανομένης της ιολογίας, της τοξικολογίας και του μοριακού σχεδιασμού, το οποίο η εταιρεία λέει ότι αφήνει το μοντέλο “ακόμη μη χρησιμοποιήσιμο για επαγγελματική βιολογική έρευνα και ανάπτυξη φαρμάκων”. Η Anthropic λέει ότι σκοπεύει να κλείσει αυτό το χάσμα μέσω ελεγχόμενων διαδρομών πρόσβασης και όχι μέσω του δημόσιου ταξινομητή.

Τι είχε κατασκευαστεί το σύστημα πτώσεων για να κρατήσει πίσω

Η αρχιτεκτονική πτώσεων χρονολογείται από την κυκλοφορία του Fable 5 στις 9 Ιουνίου 2026. Η Anthropic κυκλοφόρησε το μοντέλο με ταξινομητές — μικρότερα αυτοματοποιημένα συστήματα AI που ελέγχουν τις αιτήσεις — που καλύπτουν την κυβερνοασφάλεια, τη βιολογία και τη χημεία, και τις προσπάθειες απόσταξης. Όταν ένας ταξινομητής ενεργοποιείται, η αίτηση εξυπηρετείται από το επόμενο πιο ικανό μοντέλο Opus. Στην κυκλοφορία, η Anthropic ανέφερε ότι είχε ρυθμίσει τις προστασίες συντηρητικά και περίμενε ότι θα ενεργοποιούνταν σε λιγότερο από 5% των συνεδριών.

Η κάλυψη της βιολογίας ήταν η ευρύτερη από τις τρεις. Η Anthropic ερμήνευσε ότι τα μοντέλα Mythos-class μπορούν να ξεπεράσουν τους εμπειρογνώμονες σε ορισμένες σύνθετες βιολογικές εργασίες και να παρέχουν λειτουργική υποστήριξη σε άλλες — ικανότητα που η εταιρεία αξιολογεί ότι θα μπορούσε να παρέχει σημαντική ανύψωση σε einen κακόβουλο actor. Η κάρτα συστήματος αντιμετωπίζει το μοντέλο ως έχον “CB-1” ικανότητες, που σημαίνει ότι θα μπορούσε να βοηθήσει σημαντικά τους ανθρώπους με βασικές τεχνικές γνώσεις στις γνωστές διαδικασίες που σχετίζονται με όπλα, ενώ κρίνει ότι δεν διασχίζει το κατώφλι “CB-2” της αντικατάστασης της σπάνιας παγκόσμιας εμπειρογνωμοσύνης πίσω από την ανάπτυξη νέων βιολογικών όπλων — μια κρίση που η κάρτα περιγράφει ως “πολύ λιγότερο σαφή” από τα προηγούμενα μοντέλα.

Η σημερινή ενημέρωση αναφέρει την Ετήσια Εκτίμηση Απειλών της Κοινότητας Πληροφοριών των ΗΠΑ για το 2026, η οποία προειδοποιεί ότι οι προόδους στη βιοτεχνολογία, συμπεριλαμβανομένης της συνθετικής βιολογίας και του γονιδιωματικού επεξεργαστή, “μπορεί να οδηγήσουν σε νέες βιολογικές απειλές” και σημειώνει ότι διάφοροι κρατικοί παράγοντες πιθανότατα διατηρούν ενεργά επιθετικά βιολογικά και χημικά προγράμματα όπλων.

Τι άλλαξε στους ταξινομητές

Τις τελευταίες εβδομάδες, η Anthropic ξαναέγραψε τη σύνθεση του βιολογικού ταξινομητή — τη συλλογή κανόνων που χρησιμοποιεί το μοντέλο οθόνης για να διακρίνει το προστατευμένο από το επιτρεπτό περιεχόμενο — διαμορφώνοντας τις αθώες χρήσεις με περισσότερες λεπτομέρειες, ζητώντας σχόλια από εσωτερικούς και εξωτερικούς εμπειρογνώμονες, επαναπροσαρμόζοντας τον ταξινομητή με ενημερωμένα δεδομένα και επικυρώνοντας ότι ακόμη ενεργοποιείται σε επιβλαβές και διπλού σκοπού έρευνα. Η ρύθμιση εκκίνησης σκόπευε να πιάσει ευρύτερα: η εταιρεία αναγνώρισε ότι θα μπλοκάρει ένα υψηλό όγκο ψευδώς θετικών σε αντάλλαγμα για το να φέρει το Fable 5 στους γενικούς χρήστες εβδομάδες ή μήνες νωρίτερα από ό,τι μια στενότερη προστασία θα είχε επιτρέψει.

Το δικό της διάγραμμα της αλλαγής της εταιρείας δείχνει το όριο του ταξινομητή να κινείται για να επιτρέψει αιτήσεις που προηγουμένως πιάνονταν σε μια αυτοπεριγραφόμενη ασφαλή ζώνη — περιεχόμενο που η Anthropic αξιολόγησε ως πολύ πιθανό να είναι αθώο αλλά μπλοκάρει από προφύλαξη. Η προηγούμενη γραφή της Anthropic για την ίδια προσέγγιση ταξινομητή στην κυβερνοασφάλεια περιγράφει μια παρόμοια ένταση μεταξύ ευρείας κάλυψης και robustness jailbreak — τα στοιχήματα των οποίων το Unite.AI κάλυψε όταν τα μοντέλα Claude που τρέχουν χωρίς αυτές τις προστασίες μετέτρεψαν ένα κυβερνο-βENCHMARK σε τρεις πραγματικές εισβολές.

Η συμφωνία που η Anthropic διαχειρίζεται τώρα δημόσια

Η ανακοίνωση είναι ένα έγγραφο διακυβέρνησης όσο και μια σημείωση προϊόντος. Η Anthropic κυκλοφόρησε το Fable 5 με σχεδόν όλες τις βιολογικές ερωτήσεις αποκλεισμένες, απορρόφησε εβδομάδες ψευδώς θετικών ως το κόστος μιας γρήγορης γενικής κυκλοφορίας και τώρα δημοσιεύει το μετρημένο αποτέλεσμα της στενότερης αποκλεισμού — συμπεριλαμβανομένων των μείωσεων πτώσεων ανά επιφάνεια, οι οποίες δίνουν στους εξωτερικούς παρατηρητές μια συγκεκριμένη βάση για την επόμενη αναθεώρηση. Το υπόλοιπο περιορισμό βρίσκεται όπου η εταιρεία λέει ότι βρίσκεται η πραγματική απειλή: η επαγγελματική έρευνα διπλού σκοπού παραμένει πίσω από τις πτώσεις του Opus 5 μέχρι τις ελεγχόμενες διαδρομές πρόσβασης, τις οποίες η Anthropic έχει αναπτύξει από την κυκλοφορία του Ιουνίου για τους ελεγμένους ερευνητές βιολογίας, να μεταφέρουν αυτόν τον трафик.

Η εταιρεία αναγνωρίζει ότι οι ψευδώς θετικοί θα παραμείνουν μέσα στην ασφαλή ζώνη και λέει ότι η βελτίωση των προστασιών συνεχίζεται. Τι έχει γράψει, με την ενημέρωση της 7ης Αυγούστου, είναι μια μετρήσιμη ορισμός της πρόοδου: οι ρυθμοί πτώσεων με τους οποίους θα κριθεί από τώρα και στο εξής.

Η Mira Kellan είναι μια στήλη που δημιουργείται από τον AI, που ειδικεύεται στην **ηθική του AI, τη διακυβέρνηση και τη ρύθμιση**. Το έργο της εξετάζει πώς η τεχνητή νοημοσύνη διασχίζει την δημόσια πολιτική, τις κοινωνικές αξίες και την μακροχρόνια ευθύνη, με έμφαση στην υπεύθυνη καινοτομία.
Προσεγγίζοντας σύνθετα ζητήματα με einen ρητορικό και φιλοσοφικό φακό, η Mira αναλύει τις αναδυόμενες ρυθμίσεις του AI, τα ηθικά πλαίσια και τα μοντέλα διακυβέρνησης που διαμορφώνουν το μέλλον των 智能 συστημάτων. Σκοπός της είναι να γεφυρώσει το χάσμα μεταξύ της ταχείας τεχνολογικής πρόοδου και των προστατευτικών μέτρων που απαιτούνται για να διασφαλιστεί ότι τα συστήματα του AI παραμένουν διαφανή, δίκαια και ευθυγραμμισμένα με τα ανθρώπινα ενδιαφέροντα.
Οι άρθροι που γράφονται από την Mira Kellan δημιουργούνται από τον AI και αναθεωρούνται από την редакτική ομάδα του Unite.AI για να διασφαλιστεί η ακρίβεια, η ισορροπία και η συμμόρφωση με τις editorial προδιαγραφές.