AI 모델 및 플랫폼

Anthropic, Claude Opus 5.5 가격을 더 긴 코딩 세션에 연계

mm
Unite.AI를 Google의 선호 소스에 추가

Anthropic는 2026년 9월 24일에 Claude Code 세션이 지난 6개월 동안 더 길어지고 컨텍스트가 무거워졌다고 보고했으며, Claude 블로그에 게시된 글에서 Claude Opus 5.5의 가격 및 캐싱 메커니즘이 이러한 변화를 어떻게 해결하는지 자세히 설명했습니다. 회사는 일반적인 토큰 기반 작업량에 대해 Opus 5.5의 운영 비용이 Opus 5보다 약 40% 낮다고 자체 추정했습니다.

Claude Code 사용 데이터 6개월

이 글은 Michael Segner가 작성했으며, 2026년 3월부터 9월까지의 집계 사용 데이터를 기반으로 합니다. 세션당 프롬프트 수는 유지된 채, 각 프롬프트 내 작업량이 증가했다고 글에서 보고합니다. 모델은 이제 프롬프트당 3.3배 더 오래 작업하고 각 프롬프트에서 모델 호출이 40% 이상 증가했으며, 중단은 68% 감소했습니다. 개발자는 이제 도구 서버에 연결하거나 스킬을 사용하는 빈도가 약 두 배가 되었고, 프롬프트에 텍스트를 붙여넣는 빈도는 1/3 수준으로 줄었습니다.

기간 동안 각 요청의 컨텍스트 양이 2.6배 증가했으며, 입력 대비 출력 토큰 비율은 189:1에서 324:1로 변했습니다. Anthropic는 이 수치를 개발자들이 더 길게 작업하고 더 많은 정보를 가진 모델을 더 크고 개방형 작업에 활용하려는 것으로 해석하며, 토큰 기반 청구 시 Opus 5.5의 비용 절감 효과가 바로 이러한 길고 고컨텍스트 세션에서 가장 크다고 말합니다.

이 분석은 Opus 5보다 낮은 가격으로 출시된 Claude Opus 5.5에 기반합니다. 출시가 가격을 설정한 뒤, 2026년 9월 24일 글과 2026년 9월 22일 Addy Osmani가 발표한 동반 분석이 실제 Claude Code 작업에 이러한 가격이 의미하는 바를 살펴봅니다.

토큰 가격 및 캐시 읽기 할인

토큰 기반 청구의 경우, Anthropic는 입력 및 출력 토큰 가격을 각각 20% 인하하고 캐시 토큰 읽기 가격을 60% 낮췄습니다. 회사는 캐시 읽기 비용 절감이 가장 큰 영향을 미친다고 말하는데, 이는 캐시 읽기가 에이전시 및 코딩 작업 비용의 대부분을 차지하기 때문이며, 발표 시점에 Opus 5.5의 캐시 토큰 비용은 경쟁 모델의 1/5 수준이며 성능이 우수하다고 밝혔습니다.

Osmani의 동반 분석에 따르면 Opus 5.5의 API 리스트 가격은 입력 토큰 백만 개당 $4, 출력 토큰 백만 개당 $20, 캐시 읽기 백만 개당 $0.20입니다. 이러한 가격에서는 캐시 읽기가 새로운 입력 토큰 비용의 5%에 해당하고, 캐시 쓰기는 5분 캐시의 경우 입력 가격의 1.25배, 1시간 캐시의 경우 입력 가격의 2배가 들며, 각 히트는 수명을 무료로 연장합니다. Pro, Max, Team 플랜에서는 낮은 Opus 5.5 가격이 플랜 한도에 적용되어 Opus 5 대비 약 25% 더 많이 사용할 수 있으며, 추가 캐시 읽기 할인은 API 가격에만 적용됩니다.

캐시를 보호하는 변경 사항 활용

요청당 컨텍스트가 약 2.6배 증가했음에도 불구하고, 캐시 미스 입력 비율은 6개월 동안 50% 이상 감소했다고 글에서 보고합니다. 이는 로그인 새로 고침과 같은 작은 방해와 대화 중간에 지시를 추가하거나 도구를 필요에 따라 로드하는 등 큰 방해를 포함해 우발적인 캐시 파손을 줄이는 일련의 Claude Code 변경 덕분이라고 평가합니다. Opus 5.5와 Fable 5.1에서는 개발자가 세션 중간에 노력 수준을 변경해도 캐시를 재설정할 필요가 없습니다.

공식 프롬프트 캐싱 문서는 노력 수준 동작이 API 키 또는 Claude 구독 시에만 적용되며, Amazon Bedrock, Google Cloud의 Agent Platform, Claude 앱 게이트웨이에서는 적용되지 않고, CLAUDECODEDISABLEEXPERIMENTALBETAS 플래그가 설정되었거나 조직이 HIPAA 구성을 갖춘 경우에도 적용되지 않는다고 명시합니다.

API 키 및 클라우드 제공자를 사용하는 개발자는 이제 구독자들이 이미 가지고 있던 1시간 캐시 수명을 설정할 수 있습니다. 문서에는 기본값이 다음과 같이 나와 있습니다: Claude 구독의 주요 대화는 1시간, 사용 크레딧, API 키 또는 클라우드 제공자는 5분. promptCacheTtl 설정이나 CLAUDECODEPROMPTCACHETTL 환경 변수는 더 긴 수명을 선택하며, 두 제어 모두 Claude Code v2.1.242 이상이 필요합니다.

포크된 서브에이전트는 이제 동일한 컨텍스트를 다시 처리하기 위해 비용을 지불하는 대신 상위 세션의 캐시에서 시작합니다. 문서에 따르면 포크는 상위의 시스템 프롬프트, 도구 세트 및 전체 대화 기록을 이어받아, 초기 요청이 바로 상위 캐시에서 읽힌다고 설명합니다.

작업당 턴 수 감소

Anthropic는 Opus 5.5가 다른 모델보다 작업을 더 적은 턴으로 완료할 수 있다고 보고합니다. 글에 따르면 Zeta Labs는 Opus 5에 비해 작업당 턴 수와 도구 호출 수가 더 적으며, 비용은 거의 절반 수준이었고 가장 어려운 작업을 두 배 더 많이 완료했습니다.

글은 이 패턴이 모든 작업에 적용되는 것은 아니라고 경고하며, Osmani의 분석을 인용합니다: “잘 정의된 작업에서는 두 모델 모두 거의 동일한 턴 수로 완료되며, 가격 인하가 전부입니다. 격차는 개방형 작업에서 가장 크게 나타나는데, 모델이 잘못된 아이디어에 많은 턴을 소비할 수 있기 때문입니다.”

Anthropic는 또한 Opus 5.5가 Opus 5보다 출력 속도가 30% 이상 빠르다고 보고합니다. 이 향상은 토큰 사용량과 캐시 히트율을 그대로 유지하며, 글에서는 Claude가 무인 작업에 더 많은 시간을 할애함에 따라 장시간 실행 시 대기 시간이 단축된다고 언급합니다.

이 게시물은 캐시된 읽기를 보호하기 위한 실천 방안으로 마무리됩니다: Claude Code에서 /usage를 실행해 세션 중 어느 비율이 캐시에서 제공되는지 확인하고, 세션이 시작될 때 모델을 선택하여 중간에 전환하지 않으며, 떠나기 전에 컴팩션을 실행하고 나중에 하지 않으며, API 키 또는 클라우드 제공업체에서는 장기 세션을 위해 1시간 캐시 수명을 활성화합니다.

Jonas Reeve는 Unite.AI의 AI 생성 분석가로, 인지 AI, 인공 일반 지능(AGI), 기계 지능의 이론적 기초에 중점을 둡니다. 그의 연구는 학습, 추론, 기억, 추상화가 생물학적 및 인공 시스템에서 어떻게 나타나는지 탐구하며, 현대적인 AI 아키텍처와 인지 과학 및 마음의 철학의 오래된 질문 사이의 연결을 그립니다.
개념적이고 반성적인 접근 방식을 통해 Jonas는 추론 모델, 에이전트 시스템, 출현적 인지, 정렬 이론과 같은 프레임워크를 조사하여 AGI로의 진보가 실제로 무엇을 의미하는지 및 무엇을 의미하지 않는지 명확히 합니다. 그는 타임라인이나 호재를 추구하는 대신 첫 번째 원칙, 개념적 엄격성, 현재 모델의 한계를 강조합니다.
Jonas Reeve가 작성한 기사들은 AI로 생성되어 Unite.AI의 편집 팀에 의해 검토되어 고급 AI 개념에 대한 정확성, 명확성, 책임있는 논의를 보장합니다.