Μοντέλα και πλατφόρμες AI
Η Anthropic Εξηγεί τους Μηχανισμούς του Νερόσημου του Claude

Η Anthropic δημοσίευσε μια λεπτομερή περιγραφή στις 14 Αυγούστου 2026 για το πώς λειτουργεί το νερόσημο του κειμένου στα μελλοντικά μοντέλα του Claude, ταυτίζοντάς το με μια έκδοση της τεχνικής SynthID-Text που δημοσίευσε η Google DeepMind σε ένα επίπεδο έρευνας του 2024. Η εταιρεία παρουσίασε την τεχνική εξήγηση γύρω από την υποχρέωση συμμόρφωσης πίσω από την αλλαγή: από τις 2 Αυγούστου 2026, ο νόμος της ΕΕ για την IA απαιτεί από τους παρόχους που εξυπηρετούν την ευρωπαϊκή αγορά να σημαδεύουν το περιεχόμενο που παράγεται από την IA, και η Anthropic υπέγραψε τον κώδικα διαφάνειας του μπλοκ στις 31 Ιουλίου 2026 μαζί με περίπου 190 οργανισμούς.
Η δημοσιοποίηση έρχεται τρεις ημέρες μετά την επιβεβαίωση του Anthropic για το σχέδιο νερόσημου σε μια σελίδα υποστήριξης, που καλύφθηκε εδώ στις 11 Αυγούστου 2026. Όπου αυτή η σελίδα περιέγραφε τι κάνουν τα σημάδια, η νέα ανάρτηση περιγράφει πώς λειτουργεί το σημάδι του κειμένου, πού σπάει και τι δεν μπορεί να αποδείξει. Η Anthropic λέει ότι το νερόσημο δεν μεταφέρει καμία αναγνωρίσιμη πληροφορία, δεν απαιτεί επιπλέον token και δεν έχει καμία πρακτική επίδραση στην ποιότητα, το κόστος ή την ταχύτητα της έξοδου.
Το Νερόσημο Ζει στην Επιλογή Λέξεων, Όχι σε Κρυφούς Χαρακτήρες
Ο μηχανισμός εκμεταλλεύεται το πώς παράγουν τα μοντέλα γλώσσας το κείμενο. Σε κάθε βήμα, ένα μοντέλο επιλέγει μια λέξη από μια λίστα πιθανολογούμενων υποψηφίων· όπου πολλές επιλογές είναι περίπου ισές (“συννεφιασμένος” έναντι “γκρι” μετά το “Η καιρός σήμερα ήταν κρύος και…”), η επιλογή καθορίζεται από einen τυχαίο αριθμό. Το νερόσημο αντικαθιστά αυτήν την αυθαίρετη τυχαία με τυχαία που προέρχεται από ένα μυστικό κλειδί συν την προηγούμενη λέξη. Το κείμενο παραμένει τυχαίο για οποιοδήποτε αναγνώστη, αλλά ο καθένας που κατέχει το κλειδί μπορεί να ελέγξει αν μια ακολουθία λέξεων είναι στατιστικά συνεπής με τις επιλογές που θα έκανε ένα μοντέλο με κλειδί, και να ανατεθεί μια πιθανότητα ότι ο Claude ήταν εμπλεκόμενος.
Τίποτα δεν προστίθεται στο κείμενο, και δεν υπάρχουν κρυφές χαρακτήρες ή αόρατοι Unicode. Επειδή το μοτίβο βρίσκεται στις ίδιες τις επιλογές λέξεων, ταξιδεύει με αντίγραφα και επικόλληση κειμένου με έναν τρόπο που δεν μπορεί να προστεθεί μεταδεδομένα. Η Anthropic αντιπαραβάλλει αυτό με λογισμικό ανίχνευσης IA όπως το Pangram, το οποίο υποθέτει τη συγγραφή από στυλιστικές συνήθειες επειδή δεν έχει κανένα κλειδί παρόχου.
Το Χαρτί Πίσω από τις Αξιώσεις Ποιότητας της Anthropic
Οι εγγυήσεις ποιότητας της Anthropic βασίζονται σε μεγάλο βαθμό στο ρεκόρ της τεχνικής που υιοθέτησαν. Στο έγγραφο της Nature που εισάγει το SynthID-Text, η Google DeepMind ανέφερε ότι ελέγξαν τη μέθοδο με την παροχή ενός μοντέλου με νερόσημο σε ένα τμήμα της κυκλοφορίας Gemini και τη σύγκριση των αξιολογήσεων thumbs-up και thumbs-down με το ασημασμένο μοντέλο, βρίσκοντας keine στατιστικά σημαντική διαφορά· μια ελεγχόμενη μελέτη πλευρά-πλευρά με ανθρώπινους αξιολογητές βρήκε επίσης keine χάσμα ποιότητας. Η Anthropic λέει ότι οι δικοί της εσωτερικοί έλεγχοι δείχνουν keine επίδραση στο περιεχόμενο, τη δημιουργικότητα ή την αναγνωσιμότητα, και ότι το νερόσημο δεν προστίθεται κανένα token, οπότε το μοντέλο κοστίζει το ίδιο να εξυπηρετηθεί και να χρησιμοποιηθεί.
Η Anthropic εφαρμόζει το νερόσημο παγκοσμίως κατά την εκκίνηση αντί να το εφαρμόζει μόνο στην ΕΕ, λέγοντας ότι δεν έχει ακόμη έναν ανθεκτικό τρόπο να το περιορίσει ανά περιοχή. Αυτό κάνει την ευρωπαϊκή υποχρέωση μια παγκόσμια περιορισμό σχεδιασμού για τον Claude. Άλλοι υπογράφοντες του κώδικα, συμπεριλαμβανομένων της Google, Meta, Microsoft, Mistral και OpenAI, εφαρμόζουν τις δικές τους μεθόδους σήμανσης σύμφωνα με το ίδιο πλαίσιο, σύμφωνα με την ανακοίνωση της Ευρωπαϊκής Επιτροπής στις 31 Ιουλίου 2026.
Πού Η Anthropic Λέει ότι το Σήμα Γίνεται Ησυχό
Η ανάρτηση είναι ασυνήθιστα συγκεκριμένη σχετικά με τους τρόπους αποτυχίας. Η ανίχνευση λειτουργεί κακώς σε σύντομες περικοπές, οι οποίες προσφέρουν λίγες επιλογές λέξεων για να ελεγχθεί. Λειώνει στις πραγματικές περιγραφές, όπου η ακρίβεια περιορίζει το μοντέλο σε μια σωστή απάντηση και αφήνει το νερόσημο τίποτα να ενεργήσει, και στο κώδικα, ο οποίος πρέπει να είναι ακριβής για να εκτελεστεί. Το σήμα μπορεί να προσαρτηθεί σε τυχαίες επιλογές όπως σχόλια, αλλά, από σχεδιασμό, έχει μια αμελητέα επίδραση στο παραγόμενο κώδικα. Ένας ελαφρύς επεξεργαστής θα αφαιρέσει πιθανώς το νερόσημο· μια πλήρης ανασυγγραφή θα το αφαιρέσει.
Το σήμα δεν μπορεί επίσης να αποδείξει τι θα περίμενε ο αναγνώστης. Μια ανίχνευση απαντάει μόνο στο ερώτημα “ποια είναι η πιθανότητα ότι αυτό γράφτηκε εν μέρει από τον Claude;” Δεν μπορεί να επιβεβαιώσει ότι το κείμενο γράφτηκε από άνθρωπο, δεν μπορεί να αναγνωρίσει την έξοδο από ένα άλλο σύστημα IA — το κλειδί και η μέθοδος κάθε παρόχου διαφέρουν — και δεν μπορεί να διακρίνει “Ο Claude έγραψε αυτό” από “Ο Claude επεξεργάστηκε αυτό βαριά.” Το νερόσημο δεν μεταφέρει τίποτα που να μπορεί να αναγνωριστεί σε一个人, οργανισμό ή συζήτηση, και δεν αλλάζει τίποτα σχετικά με την ιδιοκτησία της έξοδου ή τα δικαιώματα των χρηστών σύμφωνα με τους όρους της Anthropic.
Ξεχωριστά από το νερόσημο, τα αρχεία που παράγει ο Claude σε υποστηριζόμενες μορφές όπως .png, .jpg και .svg φέρουν ένα κρυπτογραφικά υπογεγραμμένο πιστοποιητικό προέλευσης σύμφωνα με το ανοιχτό πρότυπο C2PA, αναγνώσιμο από οποιοδήποτε εργαλείο C2PA-aware.
Τι Πλέει Επόμενο για την Ανίχνευση του Νερού του Claude
Η περίοδος μετάβασης στον νόμο της ΕΕ καλύπτει τα μοντέλα της Anthropic που εκκινήθηκαν πριν από τις 2 Αυγούστου 2026· η εταιρεία λέει ότι το νερόσημο για αυτά τα παλαιότερα μοντέλα θα κυκλοφορήσει τους επόμενους μήνες. Một API ανίχνευσης νερού προγραμματίζεται, με τις λεπτομέρειες υλοποίησης που εξακολουθούν να εργάζονται, και η Anthropic σκοπεύει να παρέχει ένα εργαλείο για τον έλεγχο των πιστοποιητικών περιεχομένου των αρχείων. Το Unite.AI είχε καλύψει previously την υποχρεωτική υποχρέωση ετικέτας περιεχομένου και την υπογραφή του κώδικα διαφάνειας της Google. Το Γραφείο IA της Επιτροπής θα εκκινήσει δύο δυνάμεις εργασίας υπογράφοντων τον Σεπτέμβριο του 2026 για τη σύγκριση των πρακτικών υλοποίησης: η πρώτη δομημένη αίθουσα όπου η προσέγγιση της Anthropic θα καθίσει δίπλα σε εκείνες των άλλων μεγάλων παρόχων που υπέγραψαν τον κώδικα.












