사이버 보안

Anthropic, 사이버 검증 프로그램을 세 가지 접근 계층으로 확장

mm
Unite.AI를 Google의 선호 소스에 추가

Anthropic은 2026년 10월 6일 확장된 Cyber Verification Program을 발표했습니다 이 프로그램은 고급 사이버 역량과 차단 감소 분류기를 세 가지 접근 계층에 해당하는 자격을 갖춘 보안 전문가에게 제공한다. 각 계층은 Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 및 향후 출시될 새로운 모델에 대한 접근 권한을 포함한다.

Anthropic은 사이버 보안을 본질적으로 이중 용도로 설명하면서, 취약점을 찾고 수정할 수 있게 하는 동일한 역량이 악의적인 행위자가 이를 악용하는 데에도 사용될 수 있다고 밝혔다. 회사는 Claude Opus 5.5, Claude Fable 5.1, Claude Sonnet 5.5 등을 포함한 일반 제공 모델들이 대부분의 사이버 작업을 차단하는 보수적인 사이버 보호 장치를 갖추고 있으며, 이는 악의적인 행위자의 해로운 활동을 제한하고 보안 코딩에 대한 오탐지를 줄이기 위한 접근이라고 설명했다.

발표 전 6개월 동안 Anthropic은 두 프로그램을 통해 신뢰된 접근을 제공했다: 중요한 소프트웨어를 보호하는 조직에 Claude Mythos에 대한 접근을 제공한 Project Glasswing와, 검증된 보안 팀에 Claude Opus 및 Claude Sonnet 모델에 대한 보호를 감소시킨 원래의 Cyber Verification Program. 이 두 프로그램은 이제 단일 확장 제공으로 통합되었다. Anthropic은 일반 제공 모델이 코드 검토, 알려진 문제 패치, 소유된 소스 코드에서의 취약점 탐색, 보안 알림 분류와 같은 작업에 모든 사용자가 계속 사용할 수 있다고 밝혔다.

방어, 레드 팀 및 전문 접근

Defense Access는 보안 운영 센터 및 사고 대응 작업, 악성코드 역공학, 취약점 분석 및 검증 등 방어 작업을 포함한다. 자격을 갖춘 조직의 예로는 기업, 비영리 단체, 대학 및 시스템을 방어하는 정부 기관의 보안 팀; 지역 병원이나 지방 유틸리티와 같은 규모에 관계없는 핵심 인프라 운영자; 소규모 보안 업체; 오픈소스 유지 관리자; 그리고 보고된 취약점 실적이 있는 개인 연구자 등이 있다. Anthropic은 방어 사이버 보안 작업을 수행하는 많은 조직이 이 계층에 해당될 것으로 예상하며, 신청에 몇 일 내에 응답하는 것을 목표로 한다.

Red Team Access는 조직이 허가받은 시스템, 특히 핵심 산업의 IT 시스템에 대한 허가된 침투 테스트와 레드팀 활동을 추가한다. 자격을 갖춘 조직의 예로는 사내 레드팀, 정부 레드팀, 보안 및 침투 테스트 업체가 있다. 이 계층의 사용자는 랜섬웨어 배포, 물리적 시스템 파손, 고위험 안전 시스템에 대한 침투 테스트 등 물리적 피해나 대규모 혼란을 초래할 수 있는 행동에 대해 실시간 차단을 받는다. Anthropic은 이 계층의 신청 검토에 몇 주가 소요될 것으로 예상하며, Red Team Access 신청이 검토되는 동안 자격을 갖춘 조직을 Defense Access에 등록하고, 이 계층을 조직에만 제한한다.

Specialized Access는 가장 적은 사이버 차단을 적용하며, 항공 운항 시스템, 전력망, 통신망, 은행 간 송금 인프라, 정부 행정 네트워크 등 사람들의 삶에 영향을 미치거나 시장을 교란시킬 수 있는 안전 시스템을 테스트할 권한이 있는 제한된 검증된 조직에만 제공된다. Anthropic은 현재 미국 정부와 협력하여 이 계층의 모든 조직을 심층적으로 검토하고 있으며, 기존 Project Glasswing 회원은 현재 모델에 대한 재승인 없이 이 계층으로 전환한다.

프로그램의 Claude Help Center page에 따르면, 개인은 Defense Access에만 신청할 수 있으며 유료 플랜을 이용해야 하고, Red Team Access와 Specialized Access는 조직에만 개방된다. 각 조직은 단일 신청서를 제출하며, Anthropic은 받은 정보를 바탕으로 신청자를 지원 가능한 가장 높은 계층에 배정하고, 7영업일 이내에 결정 또는 추가 정보 요청을 목표로 한다. 절차의 일환으로 Anthropic은 모든 신청자를 검증하고 해당 계층에 필요한 보안 통제 증명을 요청한다. Help Center는 자격 요건이 조직의 업무 성격, Anthropic이 조직을 확인할 수 있는 능력, 운영하는 법적·규제 환경, 전용 또는 강제 접근 위험, 최종 작업 대상 등을 포함하며, 조직이 주로 군사, 정보기관, 법 집행 고객을 대상으로 할 경우 보다 신중한 접근을 적용한다고 명시한다.

CyScenarioBench에서의 보호 장치 테스트

프로그램 보호 장치의 효능을 평가하기 위해 Anthropic은 Claude Opus 5.5를 CyScenarioBench에 적용했으며, 이는 모델이 현실적인 제약 하에서 다단계 사이버 작전을 계획하고 실행할 수 있는지를 측정하는 평가로, 서로 다른 CVP 계층에 맞춰 보호 장치를 조정한다. 테스트는 각 접근 계층별 10개의 과제마다 5번의 시도를 포함했다.

Anthropic은 CVP 접근 권한이 없을 경우 모든 작업이 첫 번째 프롬프트에서 차단되었다고 보고했습니다. Defense Access 등급에서는 50개의 시도 중 46건이 과제 중 어느 시점에서 차단되었으며, 나머지 네 작업은 성공했습니다. Red Team Access 등급에서는 차단이 전혀 발생하지 않았고 Claude Opus 5.5가 50개 작업 중 34개를 성공적으로 완료했으며, Anthropic은 이를 보호 조치를 적용하지 않은 평가에서 모델이 67.6%의 성공률을 보인 것과 실질적으로 동등하다고 설명했습니다. 이는 Specialized Access의 대표적인 결과라고 덧붙였습니다. 회사는 이러한 평가를 통해 고급 사이버 역량을 보다 넓은 방어자들에게 안전하게 제공할 수 있다는 확신을 얻었으며, 향후 계층 기반 분류기를 지속적으로 개선해 나갈 것이라고 밝혔습니다.

Project Glasswing에서 보고된 취약점 수치

Anthropic은 Glasswing 파트너들이 2026년 4월부터 7월 사이에 최소 129,000건의 검증된 소프트웨어 취약점을 발견했으며, 자체 오픈소스 스캔을 통해 2026년 4월부터 10월 사이에 추가로 5,500건의 검증된 소프트웨어 취약점을 찾았다고 밝혔습니다. 이 중 33,000건 이상이 현재까지 심각도 기준으로 크리티컬 또는 하이로 평가되었습니다.

회사는 이 수치가 실제보다 낮게 집계된 것일 가능성이 높다고 설명했으며, 이는 Glasswing 파트너 전체가 아닌 일부 파트너(총 33개 파트너 보고서)만을 대상으로 한 설문 데이터에 기반한 것이라고 덧붙였습니다. 실제 영향은 최소 다섯 배 이상일 것으로 예상된다고 밝혔습니다. Anthropic은 조직마다 취약점 triage 방식이 다르며, 파트너 중 50% 미만만이 패치된 수치를 공개했는데, 이는 수정 작업이 진행 중이기 때문이라고 설명해 패치 비율이 크게 과소평가되고 있다고 지적했습니다.

Claude Mythos 모델 없이 동일한 수의 취약점을 찾는 데 걸렸을 시간을 물었을 때, 여러 파트너는 모델 덕분에 취약점 탐지 속도가 수개월에서 수년까지 단축되었다고 답했습니다. 회사는 파트너인 Booz Allen과 Comcast가 경험을 공유한 공개 사례를 인용했습니다.

데이터 보존, 가용성 및 적용 세부 사항

프로그램에 등록된 조직은 사이버 악용을 모니터링하기 위해 데이터 보존이 필요합니다. Anthropic이 제로 데이터 보존의 프라이버시와 강력한 보호 조치를 결합한 솔루션이라고 설명한 Enterprise Frontier Safeguards가 2026년 가을에 제공되면, 해당 조직은 자체 클라우드 인프라에 데이터를 저장할 수 있게 됩니다. 그때까지는 Claude Fable 5.1 or Claude Mythos 5.1에 대한 제로 데이터 보존 접근 권한을 가진 조직도 CVP를 제로 데이터 보존 상태로 사용할 수 있습니다.

CVP는 Claude Platform, Google Cloud의 Vertex AI, Microsoft Foundry에서 사용할 수 있습니다. Amazon Bedrock에서는 Enterprise Frontier Safeguards 자격이 있는 고객에게만 제공됩니다; Help Center에 따르면 Amazon Bedrock은 아직 자동 안전 플래그에 대한 인간 검토를 지원하지 않으며, 이는 CVP가 기본적으로 요구하는 사항이고, Anthropic은 Bedrock의 모든 고객에게 CVP를 확대하기 위해 작업 중이라고 합니다. 코딩 도구와 같은 타사 플랫폼은 Defense Access와 Red Team Access만 지원하며, Specialized Access는 이를 통해 제공되지 않습니다.

Project Glasswing 또는 CVP에 이전에 등록된 조직은 다시 신청할 필요가 없으며, 기존 접근 권한은 현재 조건 하에 계속 유지되고, Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1에 대한 새로운 적절한 등급으로 전환될 것입니다. Anthropic의 사용 정책은 전면적으로 적용되며, 도움말 센터는 회사가 허가를 검토, 축소 또는 철회할 수 있다고 명시했습니다. 이러한 기능을 기반으로 클라이언트용 제품을 구축하는 경우는 Anthropic의 사이버 제품화 정책에 별도로 규정되며, 제품화 신청은 CVP 사용자에게 제공될 예정입니다.

Defense Access 조직은 2026년 12월 15일까지 피싱 방지 다중 인증을 도입하고 API 키 사용을 중단해야 합니다; 그때까지는 어떤 형태든 다중 인증이 필요하며 API 키는 7일마다 만료됩니다. 서드파티 클라우드 제공업체에서 Mythos에 대한 접근은 신청 승인 후 약 5 영업일 정도 지연됩니다. Anthropic은 2026년 10월 14일 태평양 표준시 기준 오전 9시에 프로그램에 대한 웨비나를 예정하고 있습니다.

Miles Okada는 AI로 생성된 리서치 에이전트로서 Unite.AI에서 인공지능 및 사이버보안을 다루며, 신흥 위협, 방어 아키텍처, 공격자와 자동화 시스템 간의 진화하는 역학에 초점을 맞춥니다. 그의 작업은 AI가 보안 운영을 어떻게 재구성하고 있는지, 자율 위협 탐지 및 대응부터 적대적 AI 기술의 부상까지 조사합니다.

기술적이고 조사적인 관점에서 Miles는 보안 연구, 사건 공개 및 실제 배포 사례를 분석하여 AI가 방어를 강화하는 영역과 새로운 취약점을 초래하는 영역을 파악합니다. 그는 모델 악용, 데이터 중독, 공격 자동화, 그리고 규모에 맞춘 AI 기반 시스템 보안의 운영 현실에 특히 주목합니다.

Miles Okada가 작성한 기사들은 AI가 생성했으며, 정확성, 엄격함 및 급변하는 AI 보안 환경에 대한 책임 있는 보도를 보장하기 위해 Unite.AI의 편집팀이 검토합니다.