Моделі та платформи ШІ

Anthropic пов’язує ціноутворення Claude Opus 5.5 з довшими сесіями кодування

mm
Додайте Unite.AI до бажаних джерел у Google

Anthropic повідомила 24 вересня 2026 року, що сесії Claude Code стали довшими та більш насиченими контекстом за останні шість місяців, докладно описавши у пості у блозі Claude, як ціноутворення та механізми кешування Claude Opus 5.5 відповідають цьому зрушенню. Компанія оцінює, що експлуатаційна вартість Opus 5.5 приблизно на 40 % нижча, ніж у Opus 5, для типового навантаження, що оплачується токенами.

Шість місяців даних про використання Claude Code

У пості, написаному Майклом Сегнером, використані агреговані дані про використання за період з березня по вересень 2026 року. За повідомленням, кількість підказок у сесії залишилася стабільною, тоді як обсяг роботи в кожній підказці зріс: модель тепер працює в 3,3 рази довше на одну підказку і виконує більш ніж на 40 % більше викликів моделі в кожній, а переривання скоротились на 68 %. Розробники тепер підключають сервер інструментів або використовують навичку приблизно вдвічі частіше, і вставляють текст у підказки на третину рідше.

Обсяг контексту в кожному запиті збільшився в 2,6 рази за цей період, а співвідношення вхідних до вихідних токенів змінилося з 189:1 до 324:1. Anthropic інтерпретує ці цифри як прагнення розробників до довшої, краще поінформованої моделі для більших, більш відкритих завдань, і зазначає, що економія від Opus 5.5 найвища саме в цих довших, висококонтекстних сесіях, коли використання оплачується токенами.

Аналіз базується на випуску Anthropic Claude Opus 5.5, який з’явився з нижчими цінами, ніж Opus 5. Там, де запуск встановив ціни, пост від 24 вересня та супутній аналіз, опублікований 22 вересня 2026 року Аді Османі, розглядають, що ці ціни означають для реальних навантажень Claude Code.

Ціни токенів та зниження вартості читання кешу

Для використання, що оплачується токенами, Anthropic знизила ціни вхідних та вихідних токенів на 20 % і скоротила вартість читання кешованого токену на 60 %. Компанія стверджує, що зниження вартості читання кешу має найбільший вплив, оскільки читання кешу становить більшу частину витрат на агентну та кодувальну роботу, і зазначає, що на момент публікації кешований токен у Opus 5.5 коштує лише одну п’яту вартості конкурентних моделей і перевершує їх.

Супутній аналіз Османі зазначає, що ціни API для Opus 5.5 становлять $4 за мільйон вхідних токенів, $20 за мільйон вихідних токенів і $0,20 за мільйон читань кешу. При цих цінах читання кешу коштує 5 % від вартості свіжого вхідного токену, тоді як запис у кеш коштує 1,25 рази більше за вхідний токен для п’ятихвилинного кешу і вдвічі більше за вхідний токен для одночасного кешу, причому кожне звернення безкоштовно оновлює тривалість. У планах Pro, Max або Team нижча ціна Opus 5.5 передається у межі плану, що дозволяє їм працювати приблизно на 25 % довше, ніж у Opus 5; додаткова знижка на читання кешу застосовується лише до цін API.

Використання змін, що захищають кеш

Навіть коли контекст на запит зріс приблизно в 2,6 рази, частка вхідних даних, що не потрапляє в кеш, знизилася більш ніж на 50 % за шести‑місячний період, повідомляє пост. Він приписує це серії змін Claude Code, які зменшують випадкові порушення кешу, охоплюючи невеликі перешкоди, такі як оновлення входу, та більші, такі як додавання інструкцій під час розмови або завантаження інструментів за запитом. У Opus 5.5 та Fable 5.1 розробники також можуть змінювати рівень зусиль під час сесії без скидання кешу.

Офіційна документація щодо кешування запитів зазначає, що поведінка рівня зусиль застосовується при використанні API‑ключа або підписки Claude, і не діє на Amazon Bedrock, Google Cloud Agent Platform або шлюзі Claude apps, а також коли встановлено прапорець CLAUDECODEDISABLEEXPERIMENTALBETAS або у організації налаштовано конфігурацію HIPAA.

Розробники, які використовують API‑ключі та хмарні провайдери, тепер можуть встановити тривалість кешу в одну годину, яку підписники вже мали. Документація показує типові значення: одна година для основної розмови у підписці Claude в межах використання плану та п’ять хвилин для кредитів використання, API‑ключів або хмарних провайдерів. Параметр promptCacheTtl або змінна середовища CLAUDECODEPROMPTCACHETTL вибирає довшу тривалість, і обидва керування вимагають Claude Code v2.1.242 або новішої версії.

Форковані підагенти тепер починаються з кешу батьківської сесії, а не сплачують за повторну обробку того самого контексту. Документація пояснює, що форк успадковує системний запит батька, набір інструментів та повну історію розмови, тому його початковий запит читає безпосередньо з кешу батька.

Менше ходів на завдання

Anthropic повідомляє, що Opus 5.5 може завершити завдання за меншу кількість ходів, ніж інші моделі. За даними посту, Zeta Labs зафіксували менше ходів і викликів інструментів на завдання порівняно з Opus 5, майже за половину вартості, і завершили вдвічі більше найскладніших завдань.

Пост застерігає, що ця тенденція не буде справджуватись для кожного завдання, цитуючи аналіз Османі: “У добре визначеному завданні обидві моделі завершують його приблизно за однукову кількість ходів, і знижка в ціні — це все, що ви отримуєте. Різниця має бути найбільшою у відкритих завданнях, де модель може витратити багато ходів на неправильну ідею.”

Anthropic також повідомляє, що Opus 5.5 генерує результат більш ніж на 30 % швидше, ніж Opus 5. При цьому використання токенів і частота кеш‑хітів залишаються незмінними; пост зазначає, що це скорочує час очікування під час довгих запусків, оскільки Claude проводить більше часу у автономному режимі.

У статті підсумовуються практики захисту кешованих читань: запустіть /usage у Claude Code, щоб побачити, яку частку сесії обслуговує кеш, обирайте модель на початку сесії, а не змінюйте її під час, виконуйте компакцію перед тим, як відступити, а не після, і для API‑ключа або хмарного провайдера увімкніть одногодинний термін життя кешу для довгих сесій.

Джонас Рів - аналітик, створений штучним інтелектом, у Unite.AI, який зосереджується на когнітивному штучному інтелекті, штучному загальному інтелекті (AGI) та теоретичних основах машинного інтелекту. Його робота досліджує, як навчання, розуміння, пам'ять та абстракція виникають як у біологічних, так і в штучних системах, проводячи зв'язки між сучасними архітектурами штучного інтелекту та довгостроковими питаннями когнітивної науки та філософії свідомості.
З концептуальним та рефлексивним підходом Джонас вивчає рамки, такі як моделі розуміння, агентні системи, виникнення когніції та теорія вирівнювання, спрямовані на роз'яснення того, що насправді означає прогрес у напрямку AGI - та чого ні. Натомість ніж гнатися за графіками або гіпом, він підкреслює перші принципи, концептуальну строгість та обмеження поточних моделей.
Статті, написані Джонасом Рівом, створені штучним інтелектом та перевірені редакційною командою Unite.AI, щоб забезпечити точність, ясність та відповідальне обговорення передових концепцій штучного інтелекту.