Model dan platform AI

Anthropic Menjelaskan Mekanisme Tanda Air Teks Claude

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Anthropic menerbitkan laporan rinci pada 14 Agustus 2026 tentang bagaimana tanda air teks di model Claude masa depan bekerja, mengidentifikasinya sebagai versi teknik SynthID-Text yang diterbitkan oleh Google DeepMind dalam sebuah makalah peer-review 2024 di Nature. Perusahaan tersebut membingkai penjelasan teknis di sekitar kewajiban kepatuhan di balik perubahan tersebut: sejak 2 Agustus 2026, Undang-Undang AI Uni Eropa mengharuskan penyedia yang melayani pasar Eropa untuk menandai konten yang dihasilkan AI, dan Anthropic menandatangani kode transparansi blok pada Juli 2026 bersama dengan sekitar 190 organisasi.

Pengungkapan ini datang tiga hari setelah Anthropic mengkonfirmasi rencana penandaan air pada halaman dukungan, dilaporkan di sini pada 11 Agustus 2026. Di mana halaman tersebut menjelaskan apa yang dilakukan tanda-tanda tersebut, postingan baru menjelaskan bagaimana tanda teks bekerja, di mana ia rusak, dan apa yang tidak dapat dibuktikannya. Anthropic mengatakan tanda air tidak membawa informasi identifikasi, tidak memerlukan token tambahan, dan tidak memiliki dampak praktis pada kualitas output, biaya, atau kecepatan.

Tanda Air Hidup dalam Pilihan Kata, Bukan Karakter Tersembunyi

Mekanisme ini memanfaatkan cara model bahasa menghasilkan teks. Pada setiap langkah, model memilih satu kata dari daftar kandidat yang masuk akal; di mana beberapa pilihan hampir sama (“overcast” versus “grey” setelah “Cuaca hari ini sangat dingin dan…”), pilihan tersebut diputuskan oleh angka acak. Penandaan air menggantikan keacakan arbitrer tersebut dengan keacakan yang berasal dari kunci rahasia plus kata-kata sebelumnya. Teks tetap acak bagi setiap pembaca, tetapi siapa pun yang memegang kunci dapat menguji apakah urutan kata-kata secara statistik konsisten dengan pilihan yang akan dibuat oleh model yang diberi kunci, dan menetapkan kemungkinan bahwa Claude terlibat.

Tidak ada yang ditambahkan ke teks, dan tidak ada karakter tersembunyi atau Unicode yang tidak terlihat. Karena pola tersebut berada dalam pilihan kata itu sendiri, maka pola tersebut dapat berpindah bersama teks yang disalin dan ditempelkan dengan cara yang tidak dapat dilakukan oleh metadata yang melekat. Anthropic membandingkan ini dengan perangkat lunak pendeteksi AI seperti Pangram, yang menginferensi penulis dari kebiasaan gaya karena tidak memiliki kunci penyedia.

Jejak Kertas di Balik Klaim Kualitas Anthropic

Jaminan kualitas Anthropic sebagian besar bersandar pada catatan teknik yang diadopsinya. Dalam makalah Nature yang memperkenalkan SynthID-Text, Google DeepMind melaporkan pengujian metode tersebut dengan menyajikan model yang diberi tanda air kepada sepotong lalu lintas Gemini dan membandingkan peringkat ibu jari atas dan ibu jari bawah terhadap model yang tidak diberi tanda air, menemukan tidak ada perbedaan yang signifikan secara statistik; studi samping yang dikendalikan dengan penilai manusia juga menemukan tidak ada celah kualitas. Anthropic mengatakan pengujian internal mereka sendiri menunjukkan tidak ada dampak pada konten, kreativitas, atau keterbacaan, dan bahwa penandaan air tidak menambahkan token, sehingga model tersebut sama-sama berbiaya untuk disajikan dan digunakan.

Anthropic menerapkan tanda air secara global pada peluncuran daripada hanya di Uni Eropa, mengatakan bahwa mereka belum memiliki cara yang tahan lama untuk membatasinya berdasarkan wilayah. Hal ini membuat kewajiban Eropa menjadi kendala desain global untuk Claude. Penandatangan kode lainnya, termasuk Google, Meta, Microsoft, Mistral, dan OpenAI, menerapkan metode penandaan mereka sendiri di bawah kerangka yang sama, sesuai dengan pengumuman Komisi Eropa pada 31 Juli 2026.

Di Mana Anthropic Mengatakan Tanda Air Menghilang

Postingan tersebut secara tidak biasa spesifik tentang mode kegagalan. Pendeteksian bekerja buruk pada passage singkat, yang menawarkan sedikit pilihan kata untuk diuji. Hal ini menipis pada teks faktual, di mana akurasi membatasi model untuk satu jawaban yang benar dan meninggalkan tanda air tidak berfungsi, dan pada kode, yang harus tepat untuk dijalankan. Tanda air dapat melekat pada pilihan acak seperti komentar tetapi, oleh desain, memiliki efek yang dapat diabaikan pada kode yang dihasilkan. Edit ringan mungkin tidak akan menghapus tanda air; penulisan ulang penuh akan.

Tanda air juga tidak dapat membuktikan apa yang mungkin diasumsikan oleh pembaca. Pendeteksian hanya menjawab pertanyaan “apa kemungkinan ini sebagian ditulis oleh Claude?” Tanda air tidak dapat mengkonfirmasi teks yang ditulis oleh manusia, tidak dapat mengidentifikasi output dari sistem AI lain — setiap penyedia memiliki kunci dan metode yang berbeda — dan tidak dapat membedakan “Claude menulis ini” dari “Claude menyunting ini secara besar-besaran.” Tanda air tidak membawa apa pun yang dapat dilacak ke orang, organisasi, atau obrolan, dan tidak mengubah apa pun tentang kepemilikan output atau hak pengguna di bawah ketentuan Anthropic.

Terkait dengan tanda air, file yang dihasilkan oleh Claude dalam format yang didukung seperti .png, .jpg, dan .svg membawa kredensial provenance yang ditandatangani secara kriptografis di bawah standar C2PA yang terbuka, C2PA, yang dapat dibaca oleh setiap alat yang sadar C2PA.

Apa yang Akan Datang Berikutnya untuk Pendeteksian Tanda Air Claude

Periode transisi dalam hukum Uni Eropa mencakup model Anthropic yang diluncurkan sebelum 2 Agustus 2026; perusahaan mengatakan penandaan air untuk model yang lebih lama akan diluncurkan dalam beberapa bulan mendatang. API pendeteksian tanda air direncanakan, dengan detail implementasi yang masih disusun, dan Anthropic bermaksud menyediakan alat untuk memeriksa kredensial konten file. Unite.AI sebelumnya meliput kewajiban pelabelan wajib dan Google menandatangani kode transparansi yang sama. Kantor AI Komisi meluncurkan dua pasukan tugas penandatanganan pada September 2026 untuk membandingkan praktik implementasi: tempat pertama yang terstruktur di mana pendekatan Anthropic akan duduk bersama dengan yang lainnya penyedia besar yang menandatangani kode.

Mira Kellan adalah seorang kolomnis yang dibuat oleh AI yang mengkhususkan diri dalam etika AI, tata kelola, dan regulasi. Karyanya mengeksaminasi bagaimana kecerdasan buatan berpotongan dengan kebijakan publik, nilai-nilai sosial, dan akuntabilitas jangka panjang, dengan fokus pada inovasi yang bertanggung jawab.
Menghadapi masalah kompleks dengan lensa rasional dan filosofis, Mira menganalisis peraturan AI yang muncul, kerangka etika, dan model tata kelola yang membentuk masa depan sistem pintar. Ia bertujuan untuk menjembatani kesenjangan antara kemajuan teknologi yang cepat dan perlindungan yang diperlukan untuk memastikan sistem AI tetap transparan, adil, dan sejalan dengan kepentingan manusia.
Artikel yang ditulis oleh Mira Kellan dibuat oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, keseimbangan, dan kepatuhan terhadap standar editorial.