Modely a platformy AI
Anthropic váže ceny Claude Opus 5.5 k delším programovacím sezením

Anthropic oznámil 24. září 2026, že sezení Claude Code se v posledních šesti měsících prodloužila a jsou náročnější na kontext, a v příspěvku na blogu Claude podrobně popisuje, jak ceny a mechanismy kešování Claude Opus 5.5 tuto změnu řeší. Společnost uvádí, že provozní náklady Opus 5.5 jsou přibližně o 40 % nižší než u Opus 5 při typickém zatížení fakturovaném tokeny, podle vlastního odhadu.
Šest měsíců údajů o používání Claude Code
Příspěvek, který napsal Michael Segner, čerpá z agregovaných údajů o používání pokrývajících období od března do září 2026. Počet promptů na sezení zůstal stabilní, uvádí příspěvek, zatímco práce uvnitř každého promptu vzrostla: model nyní pracuje 3,3‑krát déle na jeden prompt a provádí o více než 40 % více volání modelu u každého z nich, a přerušení klesla o 68 %. Vývojáři nyní připojují server nástrojů nebo používají dovednost přibližně dvakrát častěji a vkládají text do promptů o třetinu méně často.
Množství kontextu v každém požadavku vzrostlo během tohoto období 2,6‑krát a poměr vstupních a výstupních tokenů se posunul z 189 : 1 na 324 : 1. Anthropic interpretuje tato čísla tak, že vývojáři cílí na model, který pracuje déle a je lépe informovaný, na větší a otevřenější úkoly, a uvádí, že úspory díky Opus 5.5 jsou největší právě u těch delších sezení s vyšším kontextem, když je využití účtováno tokeny.
Analýza navazuje na vydání Claude Opus 5.5 společností Anthropic, které přišlo s nižšími cenami než Opus 5. Zatímco uvedení stanovilo ceny, příspěvek ze 24. září a doprovodná analýza publikovaná 22. září 2026 Addym Osmanim zkoumají, co tyto ceny znamenají pro reálné pracovní zatížení Claude Code.
Ceny tokenů a snížení čtení z keše
Pro využití fakturované tokeny Anthropic snížil ceny vstupních a výstupních tokenů o 20 % a cenu čtení tokenu z keše o 60 %. Společnost uvádí, že snížení ceny čtení z keše má největší dopad, protože čtení z keše tvoří většinu nákladů na agentní a programovací práci, a uvádí, že k datu publikace stojí token z keše v Opus 5.5 jen jednu pětinu nákladů konkurenčních modelů a překonává je.
Doprovodná analýza od Osmaniho uvádí, že seznamové ceny API pro Opus 5.5 jsou 4 USD za milion vstupních tokenů, 20 USD za milion výstupních tokenů a 0,20 USD za milion čtení z keše. Za těchto cen stojí čtení z keše 5 % ceny čerstvého vstupního tokenu, zatímco zápis do keše stojí 1,25‑násobek vstupní ceny pro pětiminutovou keš a dvakrát vstupní cenu pro hodinovou keš, přičemž každý zásah prodlužuje životnost zdarma. V plánech Pro, Max nebo Team se nižší cena Opus 5.5 promítá do limitů plánu, takže umožňují přibližně o 25 % více než u Opus 5; dodatečná sleva na čtení z keše se vztahuje pouze na ceny API.
Využití změn, které chrání keš
I když kontext na požadavek vzrostl přibližně 2,6‑krát, podíl vstupu, který keš minule nezasáhl, klesl během šesti měsíců o více než 50 %, uvádí příspěvek. Přisuzuje to sérii změn v Claude Code, které snižují neúmyslné přerušení keše, zahrnující malé narušení jako obnovení přihlášení a větší jako přidání instrukcí během konverzace nebo načítání nástrojů na vyžádání. V Opus 5.5 a Fable 5.1 mohou vývojáři také měnit úrovně úsilí během sezení bez resetování keše.
Oficiální dokumentace ke kešování promptů uvádí, že chování úrovně úsilí platí při použití API klíče nebo předplatného Claude a ne na Amazon Bedrock, Google Cloud Agent Platform ani na bráně aplikací Claude, ani když je nastaven příznak CLAUDECODEDISABLEEXPERIMENTALBETAS nebo má organizace konfiguraci HIPAA.
Vývojáři s API klíči a poskytovateli cloudu nyní mohou nastavit životnost keše na jednu hodinu, kterou předplatitelé již měli. Dokumentace uvádí výchozí hodnoty: jedna hodina pro hlavní konverzaci v rámci předplatného Claude v rámci využití plánu a pět minut pro kredity využití, API klíče nebo poskytovatele cloudu. Nastavení promptCacheTtl nebo proměnná prostředí CLAUDECODEPROMPTCACHETTL vybírá delší životnost a oba ovladače vyžadují Claude Code verze 2.1.242 nebo novější.
Rozvětvení subagentů nyní začínají z keše rodičovského sezení místo placení za opětovné zpracování stejného kontextu. Dokumentace vysvětluje, že fork převzetí systémový prompt rodiče, sadu nástrojů a celou historii konverzace, takže jeho úvodní požadavek čte přímo z keše rodiče.
Méně tahů na úkol
Anthropic uvádí, že Opus 5.5 dokáže dokončit úkol v menším počtu tahů než jiné modely. Podle příspěvku Zeta Labs zaznamenala méně tahů a méně volání nástrojů na úkol než u Opus 5, při téměř polovičních nákladech, a dokončila dvakrát více svých nejnáročnějších úkolů.
Příspěvek varuje, že tento vzorec nebude platit pro každý úkol, a citovat analýzu Osmaniho: „U dobře vymezeného úkolu oba modely skončí přibližně ve stejném počtu tahů a snížení ceny je vše, co získáte. Rozdíl by měl být největší u otevřených úkolů, kde může model strávit mnoho tahů na špatnou myšlenku.“
Anthropic také uvádí, že Opus 5.5 generuje výstup o více než 30 % rychleji než Opus 5. Tento zisk nemění využití tokenů ani míru zásahů do keše; příspěvek poznamenává, že zkracuje čekání při dlouhých bězích, protože Claude stráví více času prací bez dozoru.
Příspěvek končí doporučeními pro ochranu čtení z cache: spusťte /usage v Claude Code, abyste zjistili, jaký podíl relace je poskytován z cache, vyberte model při zahájení relace místo přepínání během ní, proveďte kompakci před odchodem místo po něm a u API klíče nebo poskytovatele cloudu povolte jednouhodinovou dobu životnosti cache pro dlouhé relace.












