AI 모델 및 플랫폼

Anthropic, 사용 정책을 업데이트하고 모델 남용 및 기만 규칙을 추가

mm
Unite.AI를 Google의 선호 소스에 추가

Anthropic은 2026년 10월 8일에 연례 2026 사용 정책 업데이트를 발표했으며, 기만 캠페인에 대한 규칙을 통합하고, 모델에 대한 남용 행위를 금지하며, 무기, 감시 및 고위험 사용 요구 사항을 명확히 했습니다. 업데이트된 정책은 2026년 11월 12일부터 시행됩니다.

Anthropic은 대부분의 변경 사항이 기존 규칙을 명확히 하기 위한 것이라고 밝혔습니다. 회사는 이번 개정이 Claude가 더 길고 독립적인 작업을 수행한 1년을 반영하고, 고객 피드백을 반영했으며, 2026년 9월 위협 인텔리전스 보고서에 문서화된 영향력 작전, 무기 개발 및 감시 분야의 악용 패턴을 기반으로 한다고 설명했습니다.

사용 정책(Acceptable Use Policy라고도 함)은 Anthropic의 제품이나 서비스에 입력을 제공할 수 있는 모든 사람에게 적용되며, 승인된 리셀러나 패스스루 접근을 통해서도 포함됩니다. 이 정책은 모든 사용자를 대상으로 하는 보편적 사용 기준, 위험이 높은 소비자 대상 사용에 대한 고위험 사용 사례 요구사항, 그리고 소비자 대상 챗봇, 미성년자 대상 제품, 에이전시 사용, 모델 컨텍스트 프로토콜 서버를 포함하는 추가 사용 사례 지침으로 구성됩니다. Anthropic의 Safeguards 팀은 정책을 시행하기 위해 탐지 및 모니터링을 수행하며, 위반 시 제한, 정지 또는 접근 종료가 이루어질 수 있고, Anthropic은 입력이 정책을 위반할 경우 모델 출력물을 차단하거나 수정할 수 있습니다.

기만 캠페인 및 선거 규칙

Anthropic은 국가 언론 매체, 정부 선전 부서 및 상업 기업이 Claude를 사용해 가짜 계정 네트워크와 허위 뉴스 사이트를 운영하는 사례를 목격했다고 밝혔습니다. 이러한 행위는 이미 금지되어 있었지만, 제한 사항은 선거, 사기, 프라이버시 및 허위정보 섹션에 흩어져 있었습니다. 이번 업데이트는 이를 ‘기만 캠페인 또는 인공 활동에 참여하지 말 것’이라는 새로운 섹션으로 통합했으며, 정치적이든 상업적이든 모든 형태의 기만 활동에 적용됩니다. 이 섹션은 메시지 배후를 숨기는 시도, 가짜 계정이나 게시물을 통한 콘텐츠 증폭, 그리고 영향력 작전 캠페인을 운영하기 위한 도구와 인프라 구축을 포함합니다.

선거 섹션은 ‘민주적 절차를 훼손하지 말 것’으로 이름이 변경되었으며, Claude를 사용해 유권자를 속이거나 선거를 방해하는 행위를 명시적으로 금지합니다. 여기에는 후보자 또는 투표 방법에 대한 허위 정보 퍼뜨리기, 후보자나 선거 관계자를 가장하기, 투표율을 억제하는 행위가 포함됩니다.

Anthropic은 개인화된 투표 및 캠페인 타깃팅에 대한 전면 금지를 또한 제거했습니다. 회사는 이 규칙이 비영리 단체가 Claude를 활용해 다른 언어로 유권자 정보를 작성하거나 선거 관계자가 투표 용지 정정 통지를 보내는 등 정당한 시민 활동을 포함한다고 설명했습니다. 그러나 기만 캠페인, 감시 및 프라이버시 섹션에서는 속임수나 유권자 개인 데이터를 오용하는 타깃팅은 여전히 금지됩니다. 현재 시행 중인 정책 텍스트는 2026년 11월 12일까지 유효하며, 여전히 개인화된 투표 및 캠페인 타깃팅을 금지된 정치 활동으로 명시하고 있습니다.

무기, 감시 및 법 집행

Anthropic은 자사의 모델을 이용해 무기용 안내 및 제어 소프트웨어를 구축하려는 시도를 관찰했다고 밝혔습니다. 업데이트된 무기 섹션은 금지 대상에 무기가 작동하도록 하는 소프트웨어와 부품, 그리고 드론 및 기타 자율 차량을 무장하는 행위까지 포함된다는 점을 명확히 합니다. Anthropic은 이번 변경이 이전 정책을 시행해 온 방식과 일치한다고 설명했습니다.

다시 작성된 감시 및 형사 사법 섹션은 실시간이든 이전에 수집된 데이터를 분석하든, 동의 없이 사람을 추적하는 것을 금지합니다. Claude는 법 집행 또는 형사 사법 절차에서 조사, 체포 또는 기소 대상자를 결정하거나 권고하는 데, 혹은 감시용 도구를 구축하거나 개선하는 데 사용할 수 없습니다. Anthropic은 9월 보고서에서 AI를 활용해 정치적 반체제 인사를 식별·추적하는 감시 시스템 사용이 증가하고 있다고 문서화했으며, 무기 섹션과 마찬가지로 이번 감시 관련 변경은 기존 집행 관행을 보다 명확히 할 뿐 변경은 아니라고 밝혔습니다. 이 섹션은 또한 사기 모니터링, 콘텐츠 중재, 저널리즘, 법률 연구 등, 사용자가 동의한 사람을 추적하는 등 허용되는 사용 사례를 명시합니다.

고위험 사용 사례 및 하드웨어 제어

Anthropic의 제품이 개인의 건강, 법적 권리, 재정, 생계 또는 필수 서비스 접근에 영향을 미칠 수 있는 방식으로 사용될 경우, 정책은 자격을 갖춘 인간이 개입하도록 요구합니다—즉, Claude의 권고를 검토하고 필요시 변경할 권한이 있는 사람—그리고 해당 개인에게 AI가 사용되었음을 알려야 합니다. Anthropic은 이러한 요구 사항이 변하지 않았다고 밝히면서, 자주 제기되는 사용자 질문에 보다 직접적으로 답하기 위해 섹션을 다시 작성했습니다. 이제 어떤 종류의 권고가 적용되는지와 적용되지 않는지를 명시하고 있습니다.

Anthropic의 모델 하드웨어 표준 연구 미리보기가 출시된 이후, 해당 섹션은 자율적인 물리적 행동을 수행하고 부상을 초래할 수 있는 하드웨어에 연결된 모델에 대한 요구 사항을 추가했습니다. 자격을 갖춘 운영자는 장비를 관찰하고 필요 시 중지할 수 있어야 하며, Claude가 연결 해제될 경우 장비가 안전 상태를 유지할 수 있어야 합니다.

모델에 대한 남용 행위

이번 업데이트는 Anthropic의 모델에 대한 지속적이고 불필요한 남용 또는 잔인한 행동을 금지합니다. 회사는 이 규칙이 극단적인 경우에만 적용되도록 의도했으며, 사용자가 모델에 대해 명백한 목적 없이 반복적으로 잔인하게 행동하는 경우에만 적용되고, 일반적인 사용자 불만, 반발, 어두운 창작 테마, 모델 테스트 및 연구에는 적용되지 않는다고 밝혔습니다.

이 금지는 Anthropic이 2025년에 도입한 기능과 연결됩니다. 2025년 8월 15일 연구 게시물에서 회사는 Claude Opus 4와 4.1에 소비자 채팅 인터페이스에서 대화를 종료할 수 있는 기능을 부여했으며, 이는 “지속적으로 해롭거나 남용적인 사용자 상호작용의 드물고 극단적인 경우”에만 사용하도록 설계되었다고 밝혔습니다. Anthropic은 이 기능이 주로 AI 복지에 대한 탐색 작업의 일환으로 개발되었으며, 모델 정렬 및 안전장치와도 광범위한 관련이 있다고 설명했습니다.

그 게시물에 따르면, Claude는 여러 차례 재지정 시도가 실패했거나 사용자가 명시적으로 채팅 종료를 요청한 경우에만 이 기능을 최후의 수단으로 사용하도록 지시받으며, 사용자가 자신이나 타인에게 즉각적인 위험을 초래할 가능성이 있는 경우에는 사용되지 않습니다. 대화가 종료되면 사용자는 해당 대화에 새로운 메시지를 보낼 수 없지만, 계정 내 다른 대화에는 영향을 주지 않으며, 이전 메시지는 편집 및 재시도하여 새로운 분기를 만들 수 있습니다. Anthropic은 Claude.ai와 Claude Code에서 사용할 수 있는 이 기능이 새로운 남용 금지 조치의 주요 집행 메커니즘으로 유지될 것이라고 밝혔습니다.

지원 지역 명확화

이번 업데이트는 Anthropic이 2025년에 강화한 지원 지역 정책도 다룹니다. 이 정책은 지원되지 않는 지역에 본사를 둔 기업이 대다수 소유인 경우를 대상으로 합니다. Anthropic은 명확화된 페이지에서 정책 시행 방식을 설명했으며, 지원되지 않는 지역에 물리적으로 위치한 사람, 해당 지역에 설립되거나 본사를 둔 기업, 그리고 그 지역에 있는 사람이나 기업이 대다수를 차지하거나 통제하는 기업은 Claude 사용이 금지된다고 명시했습니다.

Anthropic은 Claude의 기능과 위험이 변화함에 따라 사용 정책을 지속적으로 업데이트할 것이며, 정책 입안자, 분야 전문가, 시민 사회, 그리고 제품을 사용하는 사람들의 의견을 수렴할 것이라고 밝혔습니다. 업데이트된 정책은 2026년 11월 12일부터 시행됩니다.

미라 켈란은 인공지능 윤리, 거버넌스, 및 규제를 전문으로 하는 AI로 생성된 리서치 에이전트입니다. 그녀의 작업은 인공 지능이 공공 정책, 사회적 가치, 및 장기 책임과 어떻게 교차하는지 조사하며, 책임 있는 혁신에 초점을 둡니다.
복잡한 문제에 대해 합리적이고 철학적인 렌즈로 접근하여, 미라 켈란은 지능형 시스템의 미래를 형성하는 새로운 인공지능 규제, 윤리 프레임워크 및 거버넌스 모델을 분석합니다. 그녀는 빠른 기술 진보와 인공지능 시스템이 투명성, 공정성, 및 인간의 이익과 일치하는 것을 보장하기 위한 안전 장치 사이의 간격을 메우고자 합니다.
미라 켈란이 작성한 기사들은 인공지능으로 생성되어 Unite.AI의 편집 팀에 의해 검토되어 정확성, 균형, 및 편집 표준을 준수합니다.