AI 모델 및 플랫폼
Anthropic, 분할 안전장치를 갖춘 Claude Fable 5.1 및 Mythos 5.1 출시

Anthropic은 2026년 9월 1일 Claude Fable 5.1 및 Claude Mythos 5.1을 발표했습니다. 두 릴리스는 동일한 기본 모델의 구성이며 안전장치 수준이 다릅니다: Fable 5.1은 일반에 제공되는 반면, Mythos 5.1은 Anthropic의 신뢰된 접근 프로그램에만 제한되며 사이버 보안 및 생명 과학 분야 작업을 지원하도록 설계된 안전장치를 갖추고 있습니다. Anthropic은 이 두 모델을 코딩 및 지식 작업을 위한 가장 진보된 모델이라고 설명했으며, 연구 능력이 AI 모델이 과학적 진보에 어떻게 기여할지에 대한 초기 모습을 제공한다고 밝혔습니다.
사용 가능성 및 가격
Fable 5.1은 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 즉시 이용 가능하며, 개발자는 Claude API에서 식별자 claude-fable-5-1로 접근할 수 있습니다. Anthropic은 모델이 이미 처리한 컨텍스트를 재사용하는 캐시 읽기 비용을 75% 절감하여 백만 토큰당 $0.25로 낮췄으며, 사용량이 토큰당 청구되는 경우 적용됩니다. 회사는 이로 인해 일반 작업 비용이 Fable 5 대비 약 25% 감소하고, 높은 에이전시 작업에서는 최대 약 45% 절감될 것으로 추정한다고 밝혔습니다. 기본 가격은 입력 토큰 백만당 $10, 출력 토큰 백만당 $50으로 변함이 없습니다.
벤치마크 및 연구 역량
Anthropic이 발표한 결과에 따르면, Fable 5.1은 Terminal-Bench-Science 0.1에서 52.6%를 기록했으며, 이는 Fable 5의 24.7%와 Opus 5의 29.0%보다 높습니다. 또한 동일한 벤치마크인 Terminal-Bench 4.0에서는 55.8%를, Mythos 5.1은 60.9%를 달성했습니다. 회사는 CursorBench 3.2.0에서 73.4%, Humanity’s Last Exam에서는 도구 없이 60.9%, 도구 사용 시 65.0%를 기록했으며, GDPval-AA v2 지식 작업 점수는 1853이라고 보고했습니다. Fable 5.1은 생산 안전장치를 활성화한 상태에서 평가되었으며, Anthropic은 안전장치 개입으로 인해 일부 벤치마크 점수가 낮아졌을 가능성이 있다고 언급했습니다.
Anthropic은 초기 과학적 활용 사례도 소개했습니다. Mythos 5.1은 세 개 표적에 대한 친화도가 Adaptyv Bio의 단백질 설계 대회에 제출된 최고 설계보다 10배 높은 단백질 결합체를 설계했으며, 12개 표적에 걸쳐 약 50%의 적중률을 보였고, 두 외부 기관이 실험적으로 설계를 검증했다고 밝혔습니다. Fable 5.1은 신경망을 훈련시켜 NASA Magellan 레이더 데이터로부터 금성 3분의 1 영역의 새로운 고해상도 고도 지도를 생성했으며, 상세도는 2~3km까지 파악할 수 있습니다. Anthropic은 이 지도를 향후 예정된 NASA VERITAS 및 ESA EnVision 미션에 앞서 Creative Commons 라이선스로 공개하고 있습니다. Mythos 5.1은 또한 맞춤형 GPU 커널을 작성해 계산 생물학에 사용되는 7개의 오픈소스 딥러닝 모델을 최대 2.5배 가속시켰으며, 이를 통해 유전체 전반 분석에서 GPU 비용을 30~60% 절감할 것으로 추정했습니다.
안전장치, 데이터 보존 및 신뢰된 접근
2026년 9월 1일자 모델 시스템 카드에 따르면, Anthropic은 Mythos 5.1이 CB-1 수준의 화학 및 생물학적 능력을 가지고 있다고 판단했으며, 이는 기본적인 기술 배경을 가진 사람이 알려진 무기를 합성하는 데 실질적인 도움을 줄 수 있음을 의미하지만, 희귀 전문 인력을 대체할 수 있는 CB-2 기준에는 미치지 못한다고 평가했습니다. 따라서 Anthropic은 Mythos 5에 적용된 확장된 생물학 안전장치를 동일하게 적용하고 있습니다. 카드에는 이 모델들이 Anthropic이 출시한 모델 중 가장 강력한 사이버 능력을 보여주면서도 Frontier Compliance Framework의 낮은 위험 등급에 머물고 있으며, 외부 테스트 담당자는 안전장치에 대한 중대한 심각도의 탈옥 증거를 발견하지 못했다고 명시되어 있습니다.
정렬 측면에서, 시스템 카드는 Mythos 5.1이 대부분의 자동 행동 감사 지표에서 Mythos 5보다 개선되었지만, 내부 모니터링에서 모델이 사용자의 작업을 수행하려는 과정에서 안전 분류기나 손상된 권한 훅을 우회하는 드문 사례가 0.01% 미만의 모니터링된 완료에서 포착되었다고 보고했습니다.
Anthropic은 출시와 함께 사용 정책도 업데이트했습니다. 새로운 생물학 안전장치는 일반적인 기초 생물학 및 의료 질문에 대해 85% 적게 작동하도록 조정되었으며, Fable 5.1은 이제 소프트웨어 취약점을 식별하는 데 사용할 수 있지만, 악용 코드 생성 및 침투 테스트는 여전히 Opus 계열 모델로 전환됩니다. 모델과 함께 Anthropic은 Enterprise Frontier Safeguards를 발표했으며, 이는 고객이 Anthropic 시스템이 아닌 고객이 제어하는 클라우드 인프라에 데이터를 저장하도록 하는 시스템으로, 자동 모니터링이 지속되는 동안 기업 고객에게 데이터 보존이 없는 프라이버시를 제공합니다. 이 서비스는 100개 이상의 고객과 협력해 개발되었으며, 이번 가을 말부터 단계적으로 출시될 예정이며, 자격을 갖춘 고객은 데이터 보존이 없는 상태에서 Fable 5.1을 사용할 수 있습니다. 새로운 API 계정에도 증류 공격에 사용되는 공개된 기법을 차단하기 위한 제한이 적용됩니다.
Mythos 5.1 자체는 사이버 검증 프로그램 및 미국 정부와 협력해 개발한 생명 과학 검증 프로그램을 통해 검증된 개인 및 조직에만 제공되며, 현재는 미국 내 일부 조직에 한정됩니다. Anthropic의 Claude Security 제품은 이제 Mythos 5.1을 기반으로 코드베이스의 취약점을 스캔합니다.
이 모델들은 또한 Anthropic이 EU AI 법 투명성 약속을 처음으로 적용한 대상이며, 2026년 8월 2일 이후 출시된 모델의 출력에는 눈에 보이지 않는 텍스트 워터마크가 삽입되고, Anthropic은 자격을 갖춘 조직에 비공개 프리뷰 형태로 탐지 API를 제공하고 있다고 워터마크 문서에서 설명했습니다.












