규제
OpenAI, EU AI Act 규정에 따라 단계적 텍스트 워터마킹을 시작

OpenAI는 2026년 10월 5일 텍스트 워터마킹에 대한 접근 방식을 제시했습니다 EU AI Act에 따라 전 세계 API 고객에게 선택적 워터마킹을 제공하고, 향후 몇 주 내에 유럽 연합에서 대상이 되는 ChatGPT 및 Codex 텍스트 출력에 보이지 않는 워터마크가 추가될 것이라고 발표했습니다.
EU AI Act는 생성 AI 제공업체가 생성된 텍스트를 기계가 읽을 수 있는 방식으로 식별 가능하도록 요구합니다. OpenAI는 텍스트 워터마킹 및 탐지를 초기 기술로서 상당한 제한이 있다고 설명했으며, 단계적 접근 방식이 법적 요구사항과 이러한 제한을 모두 반영한다고 밝혔습니다.
옵트인 API 접근 및 EU 지역 출시
2026년 10월 5일부터 전 세계 API 고객은 선택 모델에 대해 텍스트 워터마킹을 선택할 수 있으며, 기본 설정은 비활성화된 상태로 유지됩니다. OpenAI는 옵트인 설계가 고객이 워터마킹을 투명성 의무와 사용자에게 제공하는 경험에 어떻게 적용할지 결정할 수 있게 해주며, 클라우드 파트너와 협력하여 향후 몇 주 내에 해당 서비스에서 OpenAI 모델 출력에 워터마킹을 제공할 수 있게 할 것이라고 밝혔습니다.
자사 제품의 경우, OpenAI는 유럽 연합 내 모든 요금제에서 대상이 되는 ChatGPT 및 Codex 사용자에게 텍스트 워터마킹을 도입할 예정이며, 이 역시 향후 몇 주 내에 이루어집니다. 회사는 출시 시 텍스트 워터마킹을 전 세계 기본값으로 설정하지 않으며, 지역별 접근 방식을 통해 실제 사용 및 피드백으로부터 학습할 수 있다고 밝혔습니다.
OpenAI는 2026년 10월 5일 텍스트 워터마크 탐지기에 대한 접근 신청도 시작했습니다. 접근은 초기에는 승인된 연구자와 전문가 조직에 한해 개별 사례별로 EU의 AI 생성 콘텐츠 투명성에 관한 실무 지침에 따라 제한될 것이며, 텍스트 출처 평가 및 개선을 지원합니다. 이번 발표는 텍스트에만 적용되며, OpenAI는 오디오와 이미지에 대한 검증 도구(예: openai.com/verify 웹 도구 및 Content Provenance API)는 계속 공개적으로 이용 가능하다고 밝혔습니다.
textGrain 작동 방식
OpenAI의 워터마킹 기술인 textGrain은 모델이 선택한 단어에 보이지 않는 통계적 신호를 삽입하고, 회사의 탐지기는 해당 신호를 검사하여 텍스트에 OpenAI 워터마크가 포함되었는지 판단합니다. 기술 보고서 “textGrain: Entropy-Calibrated Watermarking for Language Model Text,”(2026년 10월 5일)에는 University of Pennsylvania, Yale University, OpenAI 소속 저자들이 명시되어 있습니다.
보고서에 따르면, 이 방법은 Gumbel 난수에서 파생된 비용을 갖는 최적 수송 문제를 해결함으로써 토큰 생성을 키드 무작위성과 연결하고, Kullback–Leibler 정규화가 독립성 이탈을 벌점으로 적용합니다. 엔트로피 예산은 워터마크 신호와 교환되는 평균 샘플링 엔트로피를 제한하며, 보고서는 KL 벌점이 워터마크가 제거하는 평균 엔트로피와 정확히 동일하다고 밝혀 강도 매개변수에 직접적인 정보 이론적 의미를 부여합니다. 어휘 토큰의 키드 블록에 수송 단계를 적용하면 최적화 규모가 줄어들면서 각 블록 내 토큰 확률 비율은 변하지 않습니다. 탐지기는 생성된 텍스트와 비밀 키만 필요하고, 생성 과정에서 사용된 엔트로피 예산은 필요하지 않습니다.
OpenAI는 이 기술을 오픈소스로 공개하여 다른 사람들이 이를 기반으로 개발할 수 있도록 할 계획이며, 보고서는 향후 몇 주 내에 추가 세부 사항으로 업데이트될 것이라고 밝혔습니다.
탐지 성능 및 명시된 제한 사항
OpenAI는 평가에서 textGrain이 테스트한 다른 접근 방식(텍스트용 SynthID 포함)보다 동등하거나 뛰어난 성능을 보였다고 보고했으며, 이상적인 조건에서의 높은 성능이 일상적인 사용에서 신뢰할 수 있는 탐지를 보장하지는 않는다고 경고했습니다.
목표 위양성률 1%에서, 탐지기는 심리학과 같은 콘텐츠의 200 토큰 구절 약 80%와 400 토큰 구절 약 95%에서 워터마크를 식별했다고 OpenAI는 보고했으며, 단어 선택이 덜 유연한 수학과 같은 콘텐츠에서는 훨씬 낮은 비율을 보였습니다. 400 토큰 구절에 대한 평가에서, 단어의 10%를 동의어로 교체하면 탐지율이 약 92%에서 66%로 감소했고, 25%를 교체하면 17%로 감소했습니다. 이 평가에서는 ELI5 데이터셋의 질문에 대한 워터마크가 적용된 영어 답변을 사용했습니다.
출력 품질에 대해, OpenAI는 최신 최전선 모델인 Astra를 평가하기 위해 사용하는 벤치마크 전반에서 워터마킹 여부에 따른 의미 있는 성능 차이를 발견하지 못했다고 밝혔습니다. 공개된 표에 따르면, 워터마크가 없는 텍스트와 있는 텍스트는 각각 Artificial Analysis Intelligence Index에서 49.57점과 49.76점, GPQA Diamond에서 94.44%와 93.94%를 기록했습니다. OpenAI는 탐지 제한이 초기 탐지기 접근을 승인된 연구자와 전문가 조직에 제한하기로 한 결정에 영향을 미쳤다고 말했습니다.
워터마크가 확립하지 못하는 것
OpenAI는 텍스트 워터마크가 해당 시스템이 본문에서 수행한 역할에 대한 제한적인 신호를 제공한다고 밝혔습니다. 워터마크는 인간의 기여도를 측정하지 않으며, 소유권이나 책임을 설정하지 않으며, 사용자를 식별하지 않고, 정확성을 검증하지도 않습니다. 또한 감지된 워터마크가 없다고 해서 인간이 작성했음을 증명할 수 없다고 밝혔는데, 텍스트가 너무 짧거나 편집·번역되었거나, 지원되지 않는 모델에서 나왔거나, 워터마크 도입 이전에 생성되었거나, 다른 회사의 도구로 생성되었을 수 있기 때문입니다.
탐지기는 사용자를 식별하거나 프롬프트·대화를 공개하지 않은 채 OpenAI 워터마크가 감지되는지를 보고합니다. 놓친 워터마크와 오탐 가능성을 고려해 OpenAI는 출시 시점에 이 도구를 공개하지 않을 예정입니다.
EU 투명성 의무
AI 법 제50조에 따른 투명성 의무는 AI 생성 콘텐츠 표시·감지와 딥페이크 및 특정 AI 생성 출판물 라벨링을 포함하며, 2026년 8월 2일부터 적용됩니다. Code of Practice on Transparency of AI-generated Content는 AI 사무국이 주관하고 다중 이해관계자 프로세스를 통해 독립 전문가들이 작성했으며, 최종 코드는 2026년 6월 10일에 발표되었습니다.
코드 준수는 자발적이지만, 제50조 투명성 요구사항은 법적 의무입니다. 위원회와 AI 위원회는 이 코드가 준수를 입증하기 위한 적절한 자발적 도구라고 확인했으며, 2026년 7월 말까지 약 190개의 기업 및 조직이 이 코드를 서명했다고 위원회가 밝혔습니다.
OpenAI는 탐지 기능을 지속적으로 개선하고, 워터마크가 편집 및 번역에 얼마나 견디는지 연구하며, AI 지원과 AI 저작을 구분할 방법을 모색하고, 결과를 책임 있게 해석할 수 있다고 판단될 때 탐지기 접근성을 확대할 것이라고 밝혔습니다.












