사이버 보안

Anthropic, 보안 도구에 Claude Mythos 5 배포, 3500만 달러 오픈소스 펀드

mm
Unite.AI를 Google의 선호 소스에 추가

Anthropic는 2026년 8월 21일에 Claude Mythos 5가 2026년 4월부터 검증된 방어자에게만 제한적으로 제공해 온 사이버 대응 모델이며, 이제 기업 고객을 위한 Claude Security에서 취약점 스캔을 수행하고 있다고 발표했습니다. 같은 발표에서는 Mythos 5를 보안 파트너 제품에 도입할 계획을 제시하고, 오픈소스 방어를 위한 새로운 펀드에 3,500만 달러 규모의 크레딧을 약속했으며, 회사의 사이버 검증 프로그램을 Mythos 등급 접근으로 확대할 예고도 했습니다.

이번 조치는 Anthropic가 의도적으로 천천히 진행해 온 출시의 세 번째 단계에 해당합니다. 발표에서 제시된 회사의 논리는 사용자가 모델에 직접 접근해 공격적인 작업으로 유도할 위험이 모델에 대한 직접 접근이 가능한 경우에 집중된다는 것입니다. 사용자가 “취약점 패치나 보안 경고와 같은 특정 결과”만 받을 수 있다면 위험이 크게 감소한다는 Anthropic의 주장에 따라, 이번 확장은 모델 자체에 대한 보호 장치를 유지하면서 방어적인 결과에 대한 접근성을 넓히는 것입니다.

발표에는 네 가지 구체적인 변화가 포함됩니다. 기업 고객은 이제 Mythos 5를 이용한 Claude Security 스캔을 실행할 수 있게 되었으며, Anthropic는 사이버 보안 기술 및 서비스 파트너와 협력해 방어자가 이미 사용하고 있는 도구에 모델을 통합하고 있습니다. 새로운 Defender Advantage Fund(0xDAF)는 오픈소스 소프트웨어를 보호하는 조직에 3,500만 달러 규모의 Claude 크레딧을 배분할 예정이며, 현재 검증된 조직에 Claude Opus와 Sonnet 모델에 대한 제한된 보호 장치를 제공하고 있는 사이버 검증 프로그램은 향후 몇 주 내에 해당 모델들의 보다 폭넓은 이중 용도 기능을 포함하도록 확대될 것이며, 이후 Mythos 등급 접근이 제공될 예정입니다.

Claude Security가 모델을 공개하지 않고 Mythos 5를 제공하는 방법

Claude Security는 Claude Enterprise 고객을 대상으로 공개 베타 단계에 있으며, Anthropic는 Mythos 5 스캔이 별도의 추가 비용 없이 기존 플랜의 표준 토큰 사용량으로 청구된다고 밝혔습니다. 관리자는 관리 콘솔에서 기능을 활성화할 수 있으며; claude.ai/security에서 사용자는 저장소를 선택하고 모델이 코드베이스의 취약점을 스캔합니다. 각 발견 항목은 CWE (Common Weakness Enumeration) 카테고리, 신뢰도 및 심각도 등급, 그리고 권장 수정안을 포함합니다. 사용자는 이후 웹상의 Claude Code를 열어 패치를 적용하고, 모든 패치는 실제 적용 전에 인간이 검토 및 승인해야 합니다.

핵심은 범위 설정에 있습니다. Mythos 5 스캔은 원시 모델 출력이 아니라 상세한 발견 결과를 반환하며, 이를 실행한다고 해서 Mythos에 대한 다른 영역 접근 권한이 확대되지 않습니다. 인터랙티브 패치는 조직이 Claude Code에 이미 보유하고 있는 모델을 사용합니다. 파트너 통합도 동일한 방식을 따릅니다. 파트너 제품의 최종 사용자는 Mythos 5를 직접 호출하지 않으며, 목적에 맞게 설계된 인터페이스가 백그라운드에서 모델을 실행해 정의된 작업을 수행하고, 제안된 패치 목록과 같은 의도된 산출물만 반환합니다. Anthropic는 자사와 파트너가 모델을 해당 범위 내에 머물도록 남용 방지 조치를 시행하고 있으며, 보안 제품을 구축하는 공급업체는 통합 프로그램에 관심을 등록할 수 있습니다.

파트너 채널은 Anthropic가 2026년 5월부터 구축해 온 생태계에 기반합니다. 그때 Wiz, Palo Alto Networks (PANW ), CrowdStrike (CRWD ), Accenture 등 기업이 Claude Opus 기반 사이버 제품을 구축했다고 보고했습니다. 해당 게시물의 초기 수치는 독립적으로 측정된 것이 아니라 기업 자체 보고이지만, 시장 상황을 보여줍니다. Wiz는 Opus 기반 공격 테스트 에이전트가 주당 150,000개 이상의 프로덕션 자산을 지속적으로 모니터링한다고 밝혔으며, Accenture는 1,600개 애플리케이션에 대한 보안 테스트 범위를 약 10%에서 80% 이상으로 확대하면서 스캔 소요 시간을 3~5일에서 1시간 이하로 단축했다고 전했습니다. Opus 기반 준비 서비스를 제공하는 CrowdStrike 컨설팅 책임자 Mark Manglicmot는 파트너 사례를 다음과 같이 설명했습니다. “Anthropic의 Claude Opus와 같은 최첨단 모델은 방어자에게 1년 전에는 없던 역량 이점을 제공하며, 취약점 관리를 완전히 왼쪽(초기) 단계로 끌어당깁니다.”

Palo Alto Networks는 최근 Anthropic, OpenAI 및 산업 제어 벤더를 핵심 인프라 방어에 참여시켰습니다. 또한 Harness와 같은 벤더는 머신 속도로 취약점을 스캔, 분류, 패치하는 에이전트를 제공하고 있습니다.

Project Glasswing에서 더 넓은 방어자 배포로

Anthropic가 이 모델 클래스에 대해 신중한 접근을 취한 배경은 Project Glasswing으로, 2026년 4월 7일에 Amazon Web Services, Microsoft, Google, CrowdStrike, Linux Foundation 등이 참여한 연합과 함께 시작되었습니다. 이 프로젝트는 Claude Mythos Preview를 핵심 소프트웨어를 보호하는 소규모 그룹에 제공했으며, 최대 1억 달러 규모의 사용 크레딧과 400만 달러의 직접 기부금으로 오픈소스 보안 조직을 지원했습니다. Anthropic는 Mythos Preview가 이미 수천 건의 고위험 취약점을 발견했으며, 주요 운영 체제와 웹 브라우저마다 하나씩 포함되어 있다고 밝혔습니다. 여기에는 OpenBSD의 27년 된 원격 트리거 결함, 자동화 테스트에서 5백만 번이나 놓친 FFmpeg 라인의 16년 된 버그, 그리고 연쇄적인 Linux 커널 권한 상승이 포함됩니다. 이 세 가지 모두 유지보수자에게 보고되어 공개 전에 패치되었습니다. 프로그램은 여름 내내 참여자를 추가했으며, 2026년 7월에는 Horizon3.ai가 취약점 사냥에 참여했습니다.

2026년 6월 9일, Anthropic는 모델을 두 개로 분리해 Fable 5 및 Mythos 5 출시를 진행했습니다. Claude Fable 5는 동일한 기반 모델에 안전 분류기를 적용해 사이버, 생물학, 증류 관련 질의를 Claude Opus 4.8으로 라우팅하도록 설계되었으며, 일반 이용이 가능해졌습니다. 검증된 사용자를 위한 사이버 보호가 해제된 Claude Mythos 5는 입력 토큰 백만당 10달러, 출력 토큰 백만당 50달러의 가격으로 Glasswing 파트너에게 제공되었으며, Mythos Preview 가격의 절반 이하였습니다. Anthropic는 외부 버그 바운티를 통해 1,000시간 이상의 테스트에서 보편적인 탈옥이 발생하지 않았다고 밝혔으며, 이후에도 분류기를 지속적으로 조정해 왔습니다. 예를 들어 2026년 8월 초에 Fable 5의 생물학적 보호 기능을 재조정해 차단된 쿼리를 85% 감소시켰다. Mythos 등급 모델의 트래픽은 30일 보존 요구사항을 갖고 있으며, Anthropic는 이를 안전 목적에만 사용하고 훈련에는 사용하지 않는다고 설명했습니다.

Anthropic의 사이버 방어 추진 현황 (수치로 보기)

  • $35 million Claude 크레딧이 Defender Advantage Fund(0xDAF)에 약속되어, 널리 사용되는 오픈소스 프로젝트의 실시간 취약점 패치, 다른 프로젝트가 복제할 수 있는 자동 스캔 및 패치, 그리고 프로젝트를 전체 공격 유형에 견디게 하는 접근 방식을 지원합니다.
  • $100 million 사용 크레딧이 2026년 4월 Project Glasswing에 약속되었으며, 추가로 $4 million의 직접 기부금이 포함됩니다: $2.5 million은 Linux Foundation을 통해 Alpha‑Omega와 OpenSSF에, $1.5 million은 Apache Software Foundation에 전달되었습니다.
  • $10 per million input tokens and $50 per million output tokens는 Mythos 5의 가격이며, Mythos Preview는 각각 $25와 $125였습니다.
  • More than 40개의 추가 조직이 Glasswing의 12개 초기 파트너를 넘어 중요한 소프트웨어 인프라를 유지 관리하도록 접근 권한을 부여받았습니다.
  • 83.1% versus 66.6%: Anthropic 자체 측정에 따르면 CyberGym 취약점 재현 테스트에서 Mythos Preview가 Opus 4.6보다 높은 성능을 보였습니다.

이 펀드는 Anthropic가 Glasswing을 통해 이미 시작한 작업을 확대하며, Akrites와 백악관의 Gold Eagle 이니셔티브와 같은 협조적인 취약점 수정 노력을 지원합니다. Anthropic는 규모를 파악하면서 소수의 대형 파일럿 보조금을 시작합니다.

Mythos 클래스 접근에 대한 향후 계획

단기 목표는 모두 일정에 맞춰 진행됩니다. Anthropic는 향후 몇 주 동안 Cyber Verification Program이 확대될 것이라고 밝혔습니다. 취약점 분류 및 검증과 같은 방어 기능이 Mythos 등급 모델로 이전되고, 등록된 방어자는 Opus와 Sonnet에 대한 차단이 감소하게 됩니다. 이미 승인된 조직은 별도의 조치를 취할 필요가 없으며, Anthropic는 업데이트를 제공하겠다고 전했습니다. 초기 Defender Advantage Fund 수혜자는 파일럿 보조금이 확정되는 대로 몇 주 안에 발표될 예정이며, Mythos 5를 상용 보안 제품에 통합하는 파트너 통합은 회사가 시간이 지나면서 확대할 초기 작업으로 설명되었습니다. 동시에 Anthropic는 미국 정부 파트너와 함께 Project Glasswing을 통해 Mythos 접근성을 확대하고 있으며, 이는 엄격한 보안 통제 요건을 충족하는 핵심 인프라 운영자를 대상으로 합니다.

Claude Security는 기업 고객을 위한 공개 베타 상태를 유지하고 있으며, Mythos 5 스캔은 2026년 8월 21일 현재 실시간으로 제공되고 기존 플랜의 표준 토큰 사용량으로 청구됩니다.

마일즈 오카다Unite.AI의 AI 생성 분석가로, 인공 지능과 사이버 보안을 다루며 새로운 위협, 방어 구조, 자동화 시스템과 공격자 간의 역동적인 관계에 초점을 맞추고 있습니다. 그의 연구는 보안 운영에 대한 AI의 영향, 자율적인 위협 탐지 및 응답, 그리고 적대적 AI 기술의 부상 등을 조사합니다.
기술적이고 조사적인 관점에서 마일즈는 보안 연구, 사건 공개, 실제 배포를 분석하여 AI가 방어를 강화하는 부분과 새로운 취약성을 도입하는 부분을 이해하기 위해 노력합니다. 그는 특히 모델의 악용, 데이터 중독, 자동화된 공격, 그리고 대규모 AI 기반 시스템의 보안을 위한 운영적 현실에 주목합니다.
마일즈 오카다가 작성한 기사들은 Unite.AI의 편집 팀에 의해 검토되어 빠르게变化하는 AI 보안 환경에 대한 정확성, 엄격성, 책임 있는 보도를 보장합니다.