AIモデルとプラットフォーム
アンソロジック、Claude のテキストウォーターマークのメカニズムを説明

アンソロジックは、2026 年 8 月 14 日に、将来の Claude モデルで使用されるテキストウォーターマークの仕組みについて詳細な説明を発表しました。このウォーターマークは、Google DeepMind が 2024 年の Nature 論文で発表した SynthID-Text 技術のバージョンであるとされています。同社は、技術的な説明 を、変更の背後にあるコンプライアンス義務の周りで構成しました。2026 年 8 月 2 日以降、EU の AI 法規制では、ヨーロッパ市場向けにサービスを提供するプロバイダーは、AI 生成コンテンツをマークする必要があります。アンソロジックは、2026 年 7 月に約 190 の組織とともに、ブロックの透明性コードに署名しました。
この開示は、アンソロジックが 2026 年 8 月 11 日にサポートページでウォーターマーキング計画を確認した 3 日後に来ました。サポートページでは、マークが何をするかが説明されていましたが、新しい投稿では、マークがどのように機能するか、どこで壊れるか、そして何を証明できないかが説明されています。アンソロジックによると、ウォーターマークには識別情報は含まれておらず、追加のトークンは必要とされず、出力の品質、コスト、または速度に実用的影響はありません。
ウォーターマークは単語の選択に存在し、隠し文字には存在しない
このメカニズムは、言語モデルがテキストを生成する方法を利用しています。各ステップで、モデルは候補リストから 1 つの単語を選択します。複数の選択肢がほぼ等しい場合 (「The weather today was cold and…」の後の「overcast」または「grey」)、選択はランダムな数字によって決定されます。ウォーターマーキングでは、この任意のランダム性を、シークレットキーと前の単語から導出されたランダム性に置き換えます。テキストは、どの読者にとってもランダムですが、キーを持っている人は、単語のシーケンスが、キー付きモデルが行う選択と統計的に一致するかどうかをテストし、Claude が関与した可能性を割り当てることができます。
テキストに追加されるものは何もありません。隠し文字や不可視の Unicode もありません。パターンは単語の選択自体に存在するため、添付メタデータではできないように、コピーして貼り付けられたテキストとともに移動します。アンソロジックは、これを、プロバイダーのキーがないため、スタイル的な習慣から著者性を推測する AI 検出ソフトウェアである Pangram と対比させています。
アンソロジックの品質保証の背後にある論文
アンソロジックの品質保証は、採用した技術の記録に大きく依存しています。SynthID-Text を紹介する Nature 論文で、Google DeepMind は、ウォーターマーク付きモデルを Gemini トラフィックの一部に提供し、ウォーターマークなしモデルと比較して、いいねと悪いねの評価に統計的に有意差がないことを報告しました。人間の評価者を使用した制御されたサイドバイサイドの研究でも、品質のギャップは見つかりませんでした。アンソロジックは、独自の内部テストでは、コンテンツ、創造性、または読みやすさに影響がないことを示し、ウォーターマーキングではトークンが追加されず、モデルは提供および使用に同じコストがかかることを示しています。
アンソロジックは、ウォーターマークをグローバルに適用することを計画しているため、EU のみに適用することはできません。同社は、まだ地域によってスコープを設定する方法がないためです。EU の義務は、Claude に対する世界的な設計制約となります。他の署名者、Google、Meta、Microsoft、Mistral、OpenAI も、同じフレームワークの下で独自のマーキング方法を実装しています。欧州委員会は 2026 年 7 月 31 日に 発表 しました。
アンソロジックがマークが消える場所
投稿は、失敗モードについて通常と異なるほど具体的です。検出は短いパッセージではうまく機能しません。これらは、テストするための単語の選択肢が少ないためです。検出は、事実のテキストでは薄れます。ここでは、モデルは 1 つの正しい答えに制約され、ウォーターマークは作用するものは残りません。コードでは、実行するには正確でなければならないためです。マークは、コメントのような任意の選択に付着する可能性がありますが、設計により、生成されるコードにはほとんど影響しません。軽い編集では、ウォーターマークを削除することはできません。完全な書き直しでは、ウォーターマークは削除されます。
マークは、読者が想定するものを証明することはできません。検出は、「これが部分的に Claude によって書かれた可能性は?」という質問にのみ答えます。人間によって書かれたテキストを確認することはできません。他の AI システムからの出力を識別することはできません。各プロバイダーのキーと方法は異なります。マークは、ウォーターマークが「Claude がこれを書いた」ということと「Claude がこれを大幅に編集した」ということを区別することはできません。ウォーターマークには、個人、組織、またはチャットに追跡可能なものは含まれていません。出力の所有権やユーザーの権利については、アンソロジックの条件の変更はありません。
ウォーターマークとは別に、Claude がサポートされている形式 (例: .png、.jpg、.svg) で生成するファイルには、オープンな C2PA 標準 に基づいて、暗号化された出典資格情報が付与されます。これは、C2PA 対応ツールで読み取ることができます。
Claude のウォーターマーク検出の次のステップ
EU 法律の移行期間には、2026 年 8 月 2 日前に導入された Anthropic モデルが含まれます。同社は、これらの古いモデルのウォーターマーキングを、来月中に導入する予定です。ウォーターマーク検出 API も計画されており、実装の詳細はまだ検討中です。アンソロジックは、ファイルのコンテンツ資格情報を確認するためのツールを提供する予定です。Unite.AI は、義務的なラベル付け義務 と Google が同じ透明性コードに署名 したことを前に報道しました。欧州委員会の AI オフィスは、2026 年 9 月に署名者の実施方法を比較する 2 つのタスクフォースを立ち上げます。これは、アンソロジックのアプローチが、コードに署名した他の主要プロバイダーのアプローチと並ぶ、最初の構造化された会場となります。












