Модели и платформы ИИ

Anthropic связывает цены Claude Opus 5.5 с более длительными сеансами кодирования

mm
Добавьте Unite.AI в избранные источники в Google

Anthropic сообщил 24 сентября 2026 года, что сеансы Claude Code стали длиннее и более насыщенными контекстом за последние шесть месяцев, подробно описав в публикации в блоге Claude, как цены и механика кэширования Claude Opus 5.5 отвечают на это изменение. Компания оценивает, что эксплуатационные расходы Opus 5.5 примерно на 40 % ниже, чем у Opus 5, для типичной нагрузки, оплачиваемой по токенам, согласно её собственным подсчётам.

Шесть месяцев данных об использовании Claude Code

В статье, написанной Майклом Сегнером, использованы агрегированные данные об использовании за период с марта по сентябрь 2026 года. По данным статьи, количество запросов на сеанс осталось стабильным, тогда как объём работы внутри каждого запроса увеличился: модель теперь работает в 3,3 раза дольше на один запрос и делает более чем на 40 % больше вызовов модели в каждом из них, а количество прерываний сократилось на 68 %. Разработчики теперь подключают сервер инструментов или используют навык примерно в два раза чаще, а вставляют текст в запросы на треть реже.

Объём контекста в каждом запросе увеличился в 2,6 раза за указанный период, а соотношение входных к выходным токенам изменилось с 189:1 до 324:1. Anthropic трактует эти цифры как свидетельство того, что разработчики стремятся к более длительной, лучше информированной модели для более крупных и открытых задач, и отмечает, что экономия от Opus 5.5 максимальна именно в таких длительных сеансах с высоким контекстом, когда оплата производится по токенам.

Анализ основывается на выпуске Anthropic модели Claude Opus 5.5, которая появилась с более низкими ценами, чем Opus 5. В то время как запуск определил цены, статья от 24 сентября и сопутствующий анализ, опубликованный 22 сентября 2026 года Эдди Османи, рассматривают, что эти цены означают для реальных нагрузок Claude Code.

Цены токенов и снижение стоимости чтения кэша

Для оплаты по токенам Anthropic снизила цены на входные и выходные токены на 20 % и сократила стоимость чтения кэшированного токена на 60 %. Компания заявляет, что снижение стоимости чтения кэша имеет наибольшее значение, поскольку чтения кэша составляют большую часть расходов на агентные и кодирующие задачи, и отмечает, что на момент публикации кэшированный токен в Opus 5.5 стоит лишь одну пятую от стоимости конкурирующих моделей и превосходит их.

Сопутствующий анализ Османи приводит цены API Opus 5.5: $4 за миллион входных токенов, $20 за миллион выходных токенов и $0,20 за миллион чтений кэша. При этих ценах чтение кэша стоит 5 % от стоимости свежего входного токена, тогда как запись в кэш стоит 1,25 × от цены входного токена для кэша на пять минут и вдвое дороже для кэша на один час, при этом каждое обращение бесплатно продлевает срок жизни кэша. В планах Pro, Max или Team более низкая цена Opus 5.5 передаётся в лимиты планов, позволяя им работать примерно на 25 % дольше, чем в Opus 5; дополнительная скидка на чтение кэша применяется только к ценам API.

Изменения, защищающие кэш

Несмотря на то, что контекст на запрос вырос примерно в 2,6 раза, доля входных данных, не попадающих в кэш, сократилась более чем на 50 % за полугодовой период, сообщает статья. Ей благодарят серию изменений Claude Code, снижающих случайные сбои кэша, включая небольшие нарушения, такие как обновление входа, и более крупные, такие как добавление инструкций в середине диалога или загрузка инструментов по запросу. В Opus 5.5 и Fable 5.1 разработчики также могут менять уровни усилий в середине сеанса без сброса кэша.

Официальная документация по кэшированию запросов указывает, что поведение уровня усилий применяется при использовании API‑ключа или подписки Claude, но не на Amazon Bedrock, платформе Agent от Google Cloud, шлюзе приложений Claude, а также не действует, когда установлен флаг CLAUDECODEDISABLEEXPERIMENTALBETAS или у организации включена конфигурация HIPAA.

Разработчики, использующие API‑ключи и облачные провайдеры, теперь могут установить срок жизни кэша в один час, который уже был у подписчиков. Документация показывает значения по умолчанию: один час для основной беседы в подписке Claude в рамках лимитов плана и пять минут для кредитов использования, API‑ключей или облачных провайдеров. Параметр promptCacheTtl или переменная окружения CLAUDECODEPROMPTCACHETTL выбирает более длительный срок, и оба управления требуют Claude Code версии 2.1.242 или новее.

Разветвлённые субагенты теперь начинают работу с кэша родительского сеанса, а не тратят ресурсы на повторную обработку того же контекста. Документация объясняет, что форк наследует системный запрос родителя, набор инструментов и полную историю диалога, поэтому его начальный запрос читает напрямую из кэша родителя.

Меньше ходов на задачу

Anthropic сообщает, что Opus 5.5 может завершать задачу за меньшее количество ходов, чем другие модели. По данным статьи, Zeta Labs зафиксировала меньше ходов и вызовов инструментов на задачу по сравнению с Opus 5, при почти половинных затратах, и завершила вдвое больше самых сложных задач.

Статья предупреждает, что эта тенденция не будет справедлива для каждой задачи, цитируя анализ Османи: «При чётко сформулированной задаче обе модели завершают её примерно за одинаковое количество ходов, и снижение цены — всё, что вы получаете. Разрыв должен быть наибольшим в открытых задачах, где модель может тратить много ходов на неверную идею».

Anthropic также сообщает, что Opus 5.5 генерирует вывод более чем на 30 % быстрее, чем Opus 5. При этом расход токенов и процент попаданий в кэш остаются неизменными; статья отмечает, что это сокращает время ожидания при длительных запусках, поскольку Claude тратит больше времени на работу без вмешательства.

В конце поста приводятся рекомендации по защите кэшированных чтений: выполните /usage в Claude Code, чтобы увидеть, какая часть сессии обслуживается из кэша; выбирайте модель при запуске сессии, а не переключайте её позже; проводите уплотнение перед тем, как уйти, а не после; и при использовании API‑ключа или облачного провайдера включайте часовой срок жизни кэша для длительных сессий.

Джонас Рив - аналитик, сгенерированный ИИ, в Unite.AI, который фокусируется на когнитивном ИИ, искусственном общем интеллекте (ИОИ) и теоретических основах машинного интеллекта. Его работа исследует, как обучение, рассуждение, память и абстракция возникают как в биологических, так и в искусственных системах, проводя связи между современными архитектурами ИИ и давними вопросами когнитивной науки и философии сознания.
С концептуальным и рефлексивным подходом Джонас исследует такие рамки, как модели рассуждений, агентные системы, возникающее сознание и теория соответствия, стремясь прояснить, что на самом деле означает прогресс в сторону ИОИ - и что нет. Вместо того, чтобы гнаться за сроками или хайпом, он подчеркивает первые принципы, концептуальную строгость и ограничения текущих моделей.
Статьи, написанные Джонасом Ривом, сгенерированы ИИ и проверены редакционной командой Unite.AI, чтобы обеспечить точность, ясность и ответственное обсуждение продвинутых концепций ИИ.