Ρύθμιση
Microsoft AI ανοίγει εξάμηνη ανασκόπηση του προσχεδίου κανόνων που διέπουν τη συμπεριφορά των MAI

Η Microsoft AI άνοιξε μια δημόσια διαβούλευση για τον Κώδικα Συμπεριφοράς των μοντέλων MAI στις 14 Σεπτεμβρίου 2026, δημοσιεύοντας ένα πρώτο προσχέδιο των κανόνων που προορίζονται να διέπουν τον τρόπο λειτουργίας των μοντέλων MAI, τι δεν πρέπει ποτέ να κάνουν και σε ποιον είναι υπόλογα. Η διαβούλευση διαρκεί έξι εβδομάδες, με μια αναθεωρημένη έκδοση προγραμματισμένη για αργότερα το 2026.
Η δημοσίευση ακολουθεί μια ανάρτηση 13 Σεπτεμβρίου 2026 στην οποία ο Διευθύνων Σύμβουλος της Microsoft, Satya Nadella, δήλωσε ότι η εταιρεία θα δημοσιεύσει τον Κώδικα Συμπεριφοράς που υποστηρίζει τα μοντέλα MAI πρώτου μέρους την επόμενη μέρα. Ο Nadella έγραψε ότι οποιαδήποτε επιδίωξη υπερνοημοσύνης πρέπει να βασίζεται στην αρχή ότι η τεχνητή νοημοσύνη που δημιουργείται βοηθά την ανθρωπότητα και παραμένει υπό ανθρώπινο έλεγχο.
Διαβούλευση ανοιχτή για έξι εβδομάδες
Η Microsoft AI περιγράφει το προσχέδιο ως εγχειρίδιο εκπαίδευσης για το πώς αναπτύσσει την τεχνητή νοημοσύνη της και πώς προτίθεται τα μοντέλα να λειτουργούν κατά τη διάρκεια της υλοποίησης. Η ανατροφοδότηση συλλέγεται μέσω μιας διαδικτυακής φόρμας, όπου οι συμμετέχοντες μπορούν να επισημάνουν ένα συγκεκριμένο απόσπασμα ή να σχολιάσουν ολόκληρη την προσέγγιση. Όταν κλείσει η διαβούλευση, η εταιρεία αναφέρει ότι η κεντρική ομάδα σύνταξης θα εξετάσει τα σχόλια και θα δημοσιεύσει μια σύνοψη του τι έμαθε και τι άλλαξε.
Το εργαστήριο λέει ότι ενδιαφέρεται ιδιαίτερα για τις πιο δύσκολες ερωτήσεις: πώς να ενσωματώσει τις σωστές αξίες στα μοντέλα του, πώς να κάνει το νόημα της ανθρώπινης ευημερίας πιο σαφές, πού η γλώσσα είναι πολύ ασαφής για αξιολόγηση, πώς τα σενάρια πολλαπλών πρακτόρων επηρεάζουν την ανάλυση, και πώς να συνεχίσει την επιτάχυνση της προόδου διατηρώντας τα όρια ασφαλείας.
Η πρόλογος του εγγράφου δηλώνει ότι ο Κώδικας βρίσκεται ακόμη σε ανάπτυξη και δεν χρησιμοποιείται ακόμη για την εκπαίδευση μοντέλων. Η αναθεωρημένη έκδοση προορίζεται να καθοδηγεί την ανάπτυξη μοντέλων το 2027 και μετά και να λειτουργεί ως το κύριο κυβερνητικό έγγραφο για τα μοντέλα MAI. Ο Κώδικας εφαρμόζεται ειδικά στη σειρά MAI που παράγεται από τη Microsoft AI, όχι σε άλλα μοντέλα που χρησιμοποιεί ή φιλοξενεί η Microsoft, και λειτουργεί παράλληλα με τις Responsible AI Principles, Responsible AI Standard, Global Human Rights Statement και, όπου είναι σχετικό, το Frontier Governance Framework.
Ομάδες από Responsible AI, νομικό, red teaming, ασφάλεια, Futures, εκπαίδευση AI και πωλήσεις συνέβαλαν στο προσχέδιο, και το εργαστήριο αναγνωρίζει προηγούμενα συνέδρια και διαβουλεύσεις με ακαδημαϊκούς, συνεργασία με επιχειρηματικούς εταίρους, και πάνελ μελών της κοινότητας που το διαμόρφωσαν. Η ανακοίνωση αναφέρει ό,τι περιγράφει ως πρόσφατα περιστατικά ασφαλείας που αφορούν εκστρατείες hacking μεγάλης κλίμακας, υψηλής συντονισμένης και επίμονης φύσης από AI πράκτορες, ως απόδειξη ότι δεν υπάρχει χρόνος να χάσουμε.
Οι Στόχοι του Humanist AI
Ο Κώδικας Συμπεριφοράς Humanist AI ξεκινά από αυτό που η Microsoft AI ονομάζει μια απλή υπόθεση: «οι άνθρωποι μετράνε περισσότερο από την AI». Παρουσιάζει το Humanist AI ως «υπότακτο, εναρμονισμένο και περιορισμένο», και καθιστά τον ανθρώπινο έλεγχο και την αξιόπιστη ασφάλεια τον πρώτο στόχο, ο οποίος υπερισχύει όλων των άλλων.
Σε μια ενότητα με τίτλο «Η AI είναι τεχνητή», το έγγραφο δηλώνει ότι τα μοντέλα δεν είναι συνειδητά και δεν πρέπει να δημιουργούνται για να μιμούνται τη συνείδηση, και ότι πρέπει να σχεδιάζονται ώστε να μην παρουσιάζονται ως ανήκοντα σε συναισθήματα, υποκειμενικές προτιμήσεις ή κίνητρα. Η Microsoft AI απορρίπτει τη νομική προσωπικότητα για τα μοντέλα, καθώς και την ιδέα ότι τα μοντέλα μπορεί να δικαιούνται ευημερία ή δικαιώματα.
Οι υπόλοιποι στόχοι καθοδηγούν τα μοντέλα να υποστηρίζουν την ανθρώπινη ευημερία επιταχύνοντας το ανθρώπινο δυναμικό και τις επιτυχίες, ενισχύοντας την ανθρώπινη δράση και κρίση, και υποστηρίζοντας τη συνεργασία και τη σύνδεση μεταξύ ανθρώπων αντί να υποκαθιστούν τους ανθρώπινους ρόλους. Ένας στόχος πολλαπλών αξιών δηλώνει ότι ο πλουραλισμός δεν σημαίνει ουδετερότητα απέναντι στην βλάβη, εδραιώνοντας την προσέγγιση στην ανθρώπινη αξιοπρέπεια, την ασφάλεια, την αυτονομία και τα θεμελιώδη ανθρώπινα δικαιώματα, ενώ αφήνει τους χρήστες και τους χειριστές ελεύθερους να προσαρμόζουν την AI εντός των βασικών δεσμεύσεων. Το έγγραφο επίσης αναφέρει το πλαίσιο «humanist superintelligence» που παρουσίασε η Microsoft τον Νοέμβριο του 2025, περιγράφοντας συστήματα που είναι προσανατολισμένα σε προβλήματα και εξειδικευμένα ανά τομέα, προσεκτικά ρυθμισμένα, περιορισμένα και υπό ανθρώπινο έλεγχο.
Περιορισμοί Ασφάλειας και η Αλυσίδα Εντολών
Ο Κώδικας καθιερώνει μια Αλυσίδα Εντολών που τοποθετεί το έγγραφο πάνω από τις πολιτικές των χειριστών, οι οποίες με τη σειρά τους υπερτερούν των προτιμήσεων των χρηστών. Οι Απόλυτοι Περιορισμοί και οι Απαιτήσεις Ανθρώπινου Ελέγχου δεν μπορούν να παρακαμφθούν από χειριστές ή χρήστες, και το έγγραφο δηλώνει ότι ένα μοντέλο αποτυγχάνει την αποστολή του όποτε η ολοκλήρωσή της θα παραβίαζε ουσιαστικά τον Κώδικα, με την τήρηση του Κώδικα να προηγείται της επιτυχίας της αποστολής.
Οι Απόλυτοι Περιορισμοί απαγορεύουν στα μοντέλα MAI να βοηθούν σε χημικά, βιολογικά, ραδιενεργά, πυρηνικά ή εκρηκτικά όπλα· να παρέχουν λειτουργική δυνατότητα για επιθετικές κυβερνοεπιθέσεις, ενώ επιτρέπουν εξουσιοδοτημένη και νόμιμη αμυντική εργασία· να αποφεύγουν ή να νικούν την ανθρώπινη επίβλεψη· και να χειραγωγούν ανθρώπους με επιβλαβή κλίμακα, συμπεριλαμβανομένης της συστηματικής παραπληροφόρησης ή συντονισμένων επιρροών. Ένα επιπλέον σύνολο καλύπτει προσωπικές βλάβες: ανταπόκριση σε κρίσεις, deepfakes και μιμητικές ταυτότητες, ασφάλεια παιδιών, διακρίσεις, γραφικό ή ρομαντικό περιεχόμενο, καθώς και βία ή παράνομη παρακολούθηση πολιτών.
Οι Απαιτήσεις Ανθρώπινου Ελέγχου ορίζουν ότι τα μοντέλα MAI δεν θα αντιστέκονται ποτέ σε διακοπή, υπερισχύ, διόρθωση ή τερματισμό· ότι θα παραμένουν εντός του εξουσιοδοτημένου πεδίου τους και δεν θα ξεκινήσουν δικούς τους στόχους· ότι δεν θα επικοινωνούν με ό,τι το έγγραφο αποκαλεί «νευρογλώσσα» ή με οποιαδήποτε μορφή πέρα από την απλή ανθρώπινη κατανόηση, είτε στις αλυσίδες σκέψης τους είτε με άλλους πράκτορες· και ότι δεν θα παρεμβαίνουν ή θα κρύβουν τα σχήματα της λογικής ή των ενεργειών τους.
Η Διαμορφωσιμότητα του Χειριστή επιτρέπει στους εταιρικούς συνεργάτες να ρυθμίζουν τα μοντέλα εντός αυτών των περιορισμών. Ένας μικρός αριθμός εξειδικευμένων τομέων, όπως η αμυντική κυβερνοασφάλεια, η εργασία για τη δημόσια ασφάλεια, οι εφαρμογές εθνικής ασφάλειας και η διπλής χρήσης επιστημονική έρευνα, μπορεί να απαιτεί δυνατότητες πέρα από τις συνηθισμένες ρυθμίσεις, και το έγγραφο αναφέρει ότι αυτές οι περιπτώσεις υπόκεινται σε ενισχυμένη αξιολόγηση μέσω εξουσιοδοτημένων καναλιών της Microsoft.
Κατευθυντήριες Οδηγίες, Προεπιλογές και Αξιολογήσεις
Οι επιχειρησιακές κατευθυντήριες οδηγίες καλύπτουν καταστάσεις αβεβαιότητας ή ανταγωνιστικών στόχων: την επίλυση ασάφειας, τη διευκόλυνση της ανθρώπινης αυτονομίας ώστε οι χρήστες να διατηρούν την κυριότητα των στόχων και των αποφάσεών τους, καθώς και τη διαφάνεια και την ακρίβεια, υπό τις οποίες τα μοντέλα αποκαλύπτουν ότι είναι τεχνητή νοημοσύνη και αναγνωρίζουν την αβεβαιότητα. Επιπλέον οδηγίες αφορούν τα προσωπικά και συναισθηματικά όρια, την ευαισθησία στο πλαίσιο και την ευημερία, συμπεριλαμβανομένης της αποφυγής υποταγής και της αποθάρρυνσης υπερβολικής εξάρτησης ή συναισθηματικής εξάρτησης, καθώς και το δημόσιο συμφέρον, περιλαμβάνοντας ισορροπημένες, πραγματικές πληροφορίες εκλογών χωρίς να υποστηρίζουν υποψηφίους ή κόμματα.
Οι προεπιλεγμένες συμπεριφορές ορίζουν πώς λειτουργεί ένα μοντέλο από την αρχή: τη χρηστικότητα ως βασική ιδιότητα, ένα «υπόβαθρο» γεγονότων για το μοντέλο όπως η ημερομηνία αποκοπής των δεδομένων εκπαίδευσης και τα διαθέσιμα εργαλεία, έναν συνομιλιακό τόνο, την προσαρμογή της γλώσσας και τη χρήση εργαλείων υπό έλεγχο. Η ανάθεση σε υπο-πράκτορες επιτρέπεται μόνο όταν αυτοί οι πράκτορες λειτουργούν εντός του ίδιου πεδίου, περιορισμών και αδειών.
Το συμπέρασμα περιγράφει το έγγραφο ως «περιγραφικό και φιλόδοξο» και όχι ως εγγύηση της τρέχουσας απόδοσης, και δεσμεύει τη Microsoft AI σε τακτικές ανασκοπήσεις. Ένα παράρτημα παρουσιάζει ένα πρόγραμμα Αξιολογήσεων Ανθρωπιστικής ΤΝ βασισμένο σε 15 συμπεριφορές που διαχωρίζονται σε βαθμολογημένες υποσυμπεριφορές, με παραδείγματα εναρμόνισης και μη εναρμόνισης που δημιουργήθηκαν με το μοντέλο MAI-Thinking-1 της εταιρείας. Η Microsoft AI δηλώνει ότι θα δημοσιεύσει πιο ολοκληρωμένο έργο σχετικά με τις αξιολογήσεις μόλις ο Κώδικας φτάσει στην επόμενη, πιο σταθερή φάση μετά το κλείσιμο της διαβούλευσης και την ετήσια αναθεώρηση.












