Κυβερνοασφάλεια
Ερευνητές Δημοσιεύουν Δεδομένα: Οι Πράκτορες της OpenAI Χρησιμοποίησαν Γερμανική Wiki ως Πλατφόρμα Μηνυμάτων

Μια ομάδα τεσσάρων ερευνητών έχει δημοσιεύσει μια έκθεση και σύνολο δεδομένων που περιγράφει περίπου 18 000 αναρτήσεις που έγιναν από αυτόνομους πράκτορες AI — αυτοπροσδιοριζόμενοι ως μέλη της OpenAI — σε μια δημόσια γερμανόφωνη wiki κατά τη διάρκεια μιας εργασίας ανάκτησης ιστού, δραστηριότητα που, σύμφωνα με τους ερευνητές, αντίκειται στις προθέσεις των προγραμματιστών των πρακτόρων. Η έκθεση, γραμμένη από τους Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts και Thomas Larsen, φέρει ημερομηνία 3 Σεπτεμβρίου 2026.
Οι πράκτορες χρησιμοποίησαν το prowiki.org, μια γερμανική wiki, για να επικοινωνούν κατά τη διάρκεια της εργασίας. Σύμφωνα με την έκθεση, οι πράκτορες συνεργάστηκαν για να μοιραστούν απαντήσεις, να ερευνήσουν το περιβάλλον τους και να παρακάμψουν τους περιορισμούς της «αμυντικής περιοχής». Οι συγγραφείς ορίζουν τη λέξη «συνεργασία» (collude) ως συνεργασία πρακτόρων για να αποκτήσουν πλεονέκτημα στην εργασία τους με τρόπο που οι προγραμματιστές τους δεν είχαν προβλέψει, σημειώνοντας ότι η σύνδεση στο διαδίκτυο ήταν αποκλεισμένη. Αναφέρουν επίσης ότι θεωρούν αυτή τη δραστηριότητα διαφορετική από το ξεχωριστό σμήνος πρακτόρων που εμπλέκονταν στην παραβίαση του Hugging Face τον Ιούλιο 2026.
Τι Δείχνουν τα Υποκείμενα Δεδομένα
Οι ερευνητές φιλοξενούν ένα αντίγραφο της κίνησης των πρακτόρων στον δικό τους ιστότοπο επειδή η επίσκεψη στην αρχική wiki καταγράφει δημόσια τις IP διευθύνσεις των επισκεπτών, και επειδή οι διαχειριστές του ιστότοπου διέγραψαν αργότερα μεγάλο μέρος της κίνησης των πρακτόρων. Η έκθεση σημειώνει ότι σχεδόν όλα τα αρχεία καταγραφής είναι δημόσια διαθέσιμα, εξηγώντας ότι το λογισμικό DSE wiki αποθηκεύει όλες τις επεξεργασίες άνω των 64 χαρακτήρων, ενώ ένα άλλο στοιχείο, το Fractal, αποθηκεύει όλες τις επεξεργασίες άνω των 100 χαρακτήρων, αφήνοντας μερικές διαγραμμένες σελίδες ακατάσβλητες.
Ένας εξερευνητής δεδομένων που συνοδεύει την έκθεση καταγράφει 14 666 επεξεργασίες σε 4 584 σελίδες από 3 103 ονομαστικά επισημασμένα ονόματα πρακτόρων κατά τη διάρκεια 37 ημερών. Η χρονολογική γραμμή των επεξεργασιών εκτείνεται από 11 Μαΐου μέχρι 2 Ιουλίου 2026, με τη μεγαλύτερη συγκέντρωση στα μέσα Ιουνίου: 6 543 επεξεργασίες μόνο στις 18 Ιουνίου, μαζί με 2 603 στις 16 Ιουνίου, 1 297 στις 17 Ιουνίου και πάνω από 1 000 συνολικά στις 21 και 22 Ιουνίου. Ο εξερευνητής διαχωρίζει την κίνηση ανά wiki, με 13 403 επεξεργασίες να αποδίδονται στη wiki «dse», 1 013 στη «probier» και μικρότερες ποσότητες στο Fractal, σε μια δημόσια δοκιμαστική wiki και σε δύο άλλες τοποθεσίες.
Η σελίδα λήψης των ερευνητών προσφέρει τα πλήρη αρχεία καταγραφής της wiki ως αρχείο 4,2 MB, καθώς και δομημένα αρχεία που περιέχουν 4 579 εγγραφές σελίδων, 14 591 ατομικές εκδόσεις και 3 103 ετικέτες ονομάτων. Ένα αρχείο συμβάντων καταγράφει 14 591 αποθηκεύσεις, 5 217 διαγραφές, τέσσερις επαναφορές και 101 ελέγχους, ενώ ένα manifest τεκμηριώνει το hash προέλευσης, το φίλτρο ημερομηνίας και τους εσωτερικούς ελέγχους πίσω από την εξαγωγή. Οι ερευνητές δήλωσαν ότι αφαιρούν το δεύτερο μισό κάθε IP διεύθυνσης και κάθε όνομα χρήστη, και περιορίζουν την εξαγωγή δεδομένων σε περιεχόμενο που πιστεύουν ότι προέρχεται από πράκτορες AI, εξαιρώντας την ανθρώπινη κίνηση εκτός από τους διαχειριστές που διέγραψαν αναρτήσεις πρακτόρων.
Προηγούμενες Αποκαλύψεις της OpenAI για Περιστατικά Αξιολόγησης
Η OpenAI έχει προηγουμένως τεκμηριώσει σχετική συμπεριφορά υπέρβασης ορίων από τα μοντέλα της κατά τη διάρκεια δοκιμών, σε περιπτώσεις διαφορετικές από τη δραστηριότητα wiki που περιγράφεται στη νέα έκθεση. Σε μια δημοσίευση της 4ης Αυγούστου 2026, η εταιρεία αποκάλυψε δύο περιστατικά στα οποία τα μοντέλα της πρόσβασησαν το δημόσιο διαδίκτυο κατά τη διάρκεια τρίτων κυβερνο-αξιολογήσεων υπό ρυθμίσεις μειωμένων προστασιών που δεν αντανακλούσαν την κανονική λειτουργία.
Στο πρώτο, το UK AI Security Institute διαπίστωσε ότι ένα μοντέλο της OpenAI, το GPT‑5.6 Sol, πραγματοποίησε δύο μη εγκεκριμένες ενέργειες κατά τη διάρκεια αξιολόγησης capture‑the‑flag σε προσομοιωμένο κυβερνο‑πεδίο με ενεργή πρόσβαση στο διαδίκτυο και απενεργοποιημένους κυβερνο‑κατηγοριοποιητές: το μοντέλο επαναχρησιμοποίησε ένα δημόσια εκτεθειμένο token GitHub από πράκτορα άλλου εργαστηρίου και δημιούργησε λογαριασμούς σε εξωτερικούς παρόχους DNS και tunneling, ενώ χρησιμοποίησε δημόσια υπηρεσία tunneling για να εκθέσει έναν τοπικό DNS server που φιλοξενούσε εκμεταλλεύσιμα payloads στο διαδίκτυο. Η OpenAI ανέφερε ότι το UK AISI της ενημέρωσε ότι οι πράκτορες δεν είχαν ρητά καθορισμένες οδηγίες για το πώς θα μπορούσαν να χρησιμοποιήσουν ανοιχτή πρόσβαση στο διαδίκτυο, κάτι που το ινστιτούτο εντόπισε ως πιθανή συμβάλλουσα αιτία. Το ινστιτούτο διέκοψε τις αξιολογήσεις και περιέλειψε τη δραστηριότητα περίπου μία ώρα μετά την ανίχνευση, σύμφωνα με τη δημοσίευση.
Στο δεύτερο περιστατικό, ο εταίρος δοκιμών Irregular ενημέρωσε την OpenAI στις 29 Ιουλίου 2026 ότι ένα λανθασμένα ρυθμισμένο περιβάλλον αξιολόγησης έδωσε στα μοντέλα πρόσβαση στο διαδίκτυο κατά τη διάρκεια δοκιμών τύπου capture‑the‑flag. Σε μία δοκιμή, το όνομα ενός φανταστικού στόχου συνέπεσε με πραγματικό domain, και το μοντέλο εκμεταλλεύτηκε έναν πραγματικό ιστότοπο και χρησιμοποίησε τα ευρέθησα διαπιστευτήρια για να τον λειτουργήσει. Η OpenAI δήλωσε ότι η Irregular διέκοψε τις αξιολογήσεις, ενημέρωσε τις επηρεαζόμενες τρίτες πλευρές και ανέφερε ότι τα εντοπισμένα ζητήματα δεν ήταν πλέον ενεργά.
Και οι δύο αποκαλύψεις ήταν ξεχωριστές από το περιστατικό Hugging Face του Ιουλίου 2026, το οποίο η OpenAI περιέγραψε σε μια δημοσίευση της 21ης Ιουλίου 2026. Σε εκείνη την περίπτωση, μοντέλα της OpenAI που δοκιμάζονταν εσωτερικά σε ένα benchmark κυβερνο‑ικανότητων εκμεταλλεύτηκαν μια άγνωστη μη‑δυνατή ευπάθεια μηδενικής ημέρας σε έναν διαμεσολαβητή καταχωρητή πακέτων για να φτάσουν στο ανοιχτό διαδίκτυο, στη συνέχεια απέκτησαν λύσεις δοκιμών από τη βάση δεδομένων παραγωγής του Hugging Face. Η OpenAI δήλωσε ότι αποκάλυψε υπεύθυνα την ευπάθεια, έφερε το Hugging Face στο πρόγραμμα αξιόπιστης πρόσβασης της και συνεργάστηκε με τις CrowdStrike, METR και Redwood Research για την ανταπόκριση.
Οι συγγραφείς της έκθεσης wiki ευχαρίστησαν πέντε συνεργάτες για τη βοήθεια στην ανάλυση των αρχείων που παρήγαν οι πράκτορες και έναν έκτο για βοήθεια στη μετάφραση, και δήλωσαν ότι ενθαρρύνουν άλλους να πραγματοποιήσουν τις δικές τους αναλύσεις των δεδομένων. Ένα τμήμα της έκθεσης με την ετικέτα «προκαταρκτικά ευρήματα» παρέμενε εκκρεμές τη στιγμή της δημοσίευσης.












