AI 모델 및 플랫폼

앤트로픽, 클라우드의 텍스트 워터마크 메커니즘 설명

mm
Unite.AI를 Google의 선호 소스에 추가

앤트로픽은 2026년 8월 14일 클라우드 모델의 텍스트 워터마크가 어떻게 작동하는지에 대한 자세한 설명을 발표했으며, 이를 SynthID-Text 기술의 버전으로 식별했는데, 구글 딥마인드가 2024년 Nature 논문에서 발표한 내용입니다. 회사는 기술 설명을 규제 의무 뒤에 두고 설명했는데, 2026년 8월 2일부터 EU AI 법이 유럽 시장에서 서비스를 제공하는 제공자에게 AI 생성 콘텐츠를 표시하도록 요구하며, 앤트로픽은 2026년 7월에 약 190개의 조직과 함께 이 블록의 투명성 코드에 서명했습니다.

이 공개는 앤트로픽이 2026년 8월 11일 지원 페이지에서 워터마크 계획을 확인한 지 3일 후에 이루어졌습니다. 그 페이지에서 마크가 무엇을 하는지 설명한 반면, 새로운 게시물은 텍스트 마크가 어떻게 작동하는지, 어디에서 중단되는지, 무엇을 증명할 수 없는지 설명합니다. 앤트로픽은 워터마크가 식별 정보를 포함하지 않으며, 추가 토큰이 필요하지 않으며, 출력 품질, 비용 또는 속도에 실질적인 영향을 미치지 않는다고 말합니다.

워터마크는 숨겨진 문자가 아닌 단어 선택에 존재한다

메커니즘은 언어 모델이 텍스트를 생성하는 방식을 이용합니다. 각 단계에서 모델은 가능한 후보 목록에서 하나의 단어를 선택합니다. 여러 선택이 거의 동일한 경우(“overcast” 대신 “grey”를 “The weather today was cold and…”) 선택은 임의의 숫자에 의해 결정됩니다. 워터마크는 이 임의의 무작위성을 비밀 키와 이전 단어에서 파생된 무작위성으로 대체합니다. 텍스트는 어떠한 독자에게도 임의적으로 보이지만, 키를 보유한 사람은 시퀀스의 단어가 통계적으로 키가 있는 모델이 선택할 가능성을 테스트할 수 있으며, 클라우드가 관여했을 가능성을 할당할 수 있습니다.

텍스트에 아무것도 추가되지 않으며, 숨겨진 문자나 보이지 않는 유니코드도 없습니다. 패턴이 단어 선택 자체에 존재하기 때문에, 첨부된 메타데이터와 달리 복사 및 붙여넣기된 텍스트와 함께 이동합니다. 앤트로픽은 이것을 AI 감지 소프트웨어와 대조합니다. 예를 들어 Pangram은 제공자의 키가 없기 때문에 스타일적 습관에서 저자를 추론합니다.

앤트로픽의 품질 주장의 문서 기록

앤트로픽의 품질 보장은 주로 채택한 기술의 기록에 기반합니다. SynthID-Text를 소개하는 Nature 논문에서 구글 딥마인드는 이 방법을 테스트하기 위해 워터마크가 있는 모델을 Gemini 트래픽의 일부에 제공하고, 좋아요와 싫어요 평점을 비워터마크 모델과 비교했으며, 통계적으로 유의미한 차이를 발견하지 못했습니다. 인간 평가자를 사용한 통제된 측면별 연구에서도 품질 격차를 발견하지 못했습니다. 앤트로픽은 자체 내부 테스트에서 콘텐츠, 창의성 또는 읽기 쉬움에 영향을 미치지 않는다는 것을 보여주었으며, 워터마크가 토큰을 추가하지 않기 때문에 모델을 제공하고 사용하는 데 동일한 비용이 든다고 말합니다.

앤트로픽은 출시 시 워터마크를 전 세계적으로 적용하고 있으며, 아직 지역별로 범위를 지정할 수 있는 방법이 없기 때문에 EU의 의무가 클라우드의 전 세계적 설계 제약이 되었습니다. 구글, 메타, 마이크로소프트, 미스트랄, 오픈아이와 같은 다른 코드 서명자는 동일한 프레임워크에서 자신의 마크 방법을 구현하고 있으며, 이는 2026년 7월 31일 유럽 위원회의 발표에서 확인되었습니다.

앤트로픽이 마크가 조용해지는 곳

게시물은 실패 모드에 대해异常적으로 구체적입니다. 감지는 짧은 통문에서 제대로 작동하지 않으며, 여기에는 테스트할 단어 선택이 거의 없습니다. 또한 사실적인 텍스트에서 희박해지는데, 여기서 정확성이 모델을 하나의 올바른 답변으로 제한하며, 워터마크가 작동할 수 있는 공간을 남기지 않습니다. 또한 코드에서 희박해지는데, 코드는 실행되기 위해 정확해야 하기 때문입니다. 마크는 임의의 선택에 첨부될 수 있지만, 의도적으로 코드에 거의 영향을 미치지 않습니다. 가벼운 편집은 아마도 워터마크를 제거하지 않을 것입니다. 전체 다시 작성은 할 것입니다.

마크는 또한 독자가 기대하는 것을 증명할 수 없습니다. 감지 결과는 “이 텍스트가 클라우드에 의해 부분적으로 작성되었을 가능성은?”이라는 질문에만 답을 줄 수 있습니다. 이는 인간이 작성한 텍스트를 확인할 수 없으며, 다른 AI 시스템의 출력을 식별할 수 없으며, “클라우드가 이것을 작성했다”와 “클라우드가 이것을 대폭 편집했다”를 구별할 수 없습니다. 워터마크에는 사람, 조직 또는 채팅과 관련된 추적 가능한 정보가 없으며, 출력 소유권이나 사용자 권한에 대해 아무 것도 변경하지 않습니다.

워터마크와 별도로, 클라우드가 지원하는 형식(.png, .jpg, .svg 등)으로 생성된 파일에는 C2PA 표준에 따라 암호화된 출처 자격 증명서가 첨부되어 있으며, C2PA를 인식하는 도구로 읽을 수 있습니다.

클라우드의 워터마크 감지 다음에 무엇이 제공될까?

EU 법의 전환 기간에는 2026년 8월 2일 이전에 출시된 앤트로픽 모델이 포함되며, 회사는 오래된 모델에 대한 워터마크가 향후 몇 개월 안에 롤아웃될 것이라고 말합니다. 워터마크 감지 API가 계획되어 있으며, 구현 세부 정보는 아직 작업 중입니다. 앤트로픽은 파일의 콘텐츠 자격 증명 확인을 위한 도구를 제공할 계획입니다. 유나이트.AI는 이전에 EU 법에 따라 강제적인 레이블링 의무와 구글이 같은 투명성 코드에 서명한 내용을 다루었습니다. 위원회의 AI 사무국은 2026년 9월에 코드 서명자의 구현 관행을 비교하기 위한 두 개의 작업을 시작할 것입니다. 이것은 앤트로픽의 접근 방식이 코드에 서명한 다른 주요 제공자의 접근 방식과 나란히 있을 첫 번째 구조화된 장소입니다.

미라 켈란은 인공지능 윤리, 治理, 및 규제를 전문으로 하는 인공지능 생성 칼럼니스트입니다. 그녀의 작업은 인공 지능이 공공 정책, 사회적 가치, 및 장기 책임과 어떻게 교차하는지 조사하며, 책임 있는 혁신에 초점을 둡니다.
복잡한 문제에 대해 합리적이고 철학적인 렌즈로 접근하여, 미라 켈란은 새로운 인공지능 규제, 윤리 프레임워크, 및 治理 모델을 분석하며, 지능형 시스템의 미래를 형성하는 데 영향을 미칩니다. 그녀는 빠른 기술 진보와 인공지능 시스템이 투명성, 공정성, 및 인간의 이익과 일치하는 것을 보장하기 위한 안전 장치 사이의 간격을 메우고자 합니다.
미라 켈란이 작성한 기사들은 인공지능으로 생성되어 Unite.AI의 편집 팀에 의해 검토되어 정확성, 균형, 및 편집 표준을 준수합니다.