Modele și platforme AI
Anthropic leag prețurile Claude Opus 5.5 de sesiuni de programare mai lungi

Anthropic a raportat pe 24 septembrie 2026 că sesiunile Claude Code au devenit mai lungi și mai încărcate din punct de vedere al contextului în ultimele șase luni, detaliind într-un post pe blogul Claude cum mecanismele de preț și caching ale Claude Opus 5.5 abordează această schimbare. Compania estimează că costul de funcționare al Opus 5.5 este cu aproximativ 40 % mai mic decât al Opus 5 pentru o sarcină tipică tarifată pe token, conform propriei sale estimări.
Șase luni de date de utilizare Claude Code
Postarea, scrisă de Michael Segner, se bazează pe date agregate de utilizare care acoperă perioada martie‑septembrie 2026. Numărul de prompturi pe sesiune a rămas constant, potrivit postării, în timp ce munca din fiecare prompt a crescut: modelul lucrează acum de 3,3 ori mai mult pe prompt și efectuează cu peste 40 % mai multe apeluri de model pentru fiecare, iar întreruperile au scăzut cu 68 %. Dezvoltatorii conectează acum un server de instrumente sau utilizează o abilitate de aproximativ două ori mai des și lipește text în prompturi cu o treime mai rar.
Cantitatea de context din fiecare cerere a crescut de 2,6 ori în această perioadă, iar raportul token‑uri intrare‑ieșire s-a mutat de la 189:1 la 324:1. Anthropic interpretează aceste cifre ca indicând că dezvoltatorii vizează un model care lucrează mai mult timp și este mai bine informat pentru sarcini mai mari și mai deschise, și afirmă că economiile oferite de Opus 5.5 sunt maxime pentru exact acele sesiuni mai lungi și cu context ridicat, când utilizarea este tarifată pe token.
Analiza se bazează pe lansarea Claude Opus 5.5 de către Anthropic, care a venit cu prețuri mai mici decât Opus 5. În timp ce lansarea a stabilit prețurile, postarea din 24 septembrie și o analiză însoțitoare publicată pe 22 septembrie 2026 de Addy Osmani examinează ce înseamnă aceste prețuri pentru sarcini reale Claude Code.
Prețurile token‑urilor și reducerea citirii din cache
Pentru utilizarea tarifată pe token, Anthropic a redus prețurile token‑urilor de intrare și ieșire cu 20 % și a scăzut cu 60 % prețul citirii unui token din cache. Compania afirmă că reducerea citirii din cache are cel mai mare impact deoarece citirile din cache reprezintă cea mai mare parte a costului muncii agentice și de programare, și precizează că, la data publicării, un token din cache pe Opus 5.5 costă o cincime din prețul modelelor concurente și le depășește în performanță.
Analiza însoțitoare a lui Osmani enumeră prețurile listei API ale Opus 5.5 la 4 $ pentru un milion de token‑uri de intrare, 20 $ pentru un milion de token‑uri de ieșire și 0,20 $ pentru un milion de citiri din cache. La aceste prețuri, o citire din cache costă 5 % dintr-un token de intrare proaspăt, în timp ce scrierea în cache costă de 1,25 ori prețul token‑ului de intrare pentru un cache de cinci minute și de două ori prețul pentru un cache de o oră, fiecare acces reînnoind durata gratuit. În planurile Pro, Max sau Team, prețul mai mic al Opus 5.5 este transmis limitelor planului, astfel că acestea merg cu aproximativ 25 % mai departe decât pe Opus 5; reducerea suplimentară la citirea din cache se aplică numai la prețurile API.
Valorifică modificările care protejează cache‑ul
Chiar și atunci când contextul per cerere a crescut cu aproximativ 2,6 ori, ponderea intrărilor care nu găsesc în cache a scăzut cu peste 50 % în perioada de șase luni, potrivit postării. Se atribuie o serie de modificări Claude Code care reduc întreruperile accidentale ale cache‑ului, acoperind perturbări mici, cum ar fi reîmprospătarea autentificării, și altele mai mari, cum ar fi adăugarea de instrucțiuni în mijlocul conversației sau încărcarea instrumentelor la cerere. Pe Opus 5.5 și Fable 5.1, dezvoltatorii pot, de asemenea, să schimbe nivelurile de efort în timpul sesiunii fără a reseta cache‑ul.
Documentația oficială documentație privind cache‑ul de prompturi specifică că comportamentul nivelului de efort se aplică cu o cheie API sau cu un abonament Claude și nu pe Amazon Bedrock, pe Agent Platform de la Google Cloud sau pe un gateway de aplicații Claude, nici când este activată flag‑ul CLAUDECODEDISABLEEXPERIMENTALBETAS sau când o organizație are o configurare HIPAA.
Dezvoltatorii cu chei API și furnizori de cloud pot acum seta o durată de viață a cache‑ului de o oră, pe care abonații deja o aveau. Documentația afișează valorile implicite: o oră pentru conversația principală pe un abonament Claude în cadrul utilizării planului și cinci minute pentru creditele de utilizare, cheile API sau furnizorii de cloud. Setarea promptCacheTtl sau variabila de mediu CLAUDECODEPROMPTCACHETTL selectează durata mai lungă, iar ambele controale necesită Claude Code v2.1.242 sau o versiune ulterioară.
Subagenții bifurcați încep acum din cache‑ul sesiunii părinte, în loc să plătească pentru reprocesarea aceluiași context. Documentația explică că o bifurcare preia promptul de sistem al părintelui, setul de instrumente și istoricul complet al conversației, astfel încât cererea inițială citește direct din cache‑ul părintelui.
Mai puține ture pe sarcină
Anthropic raportează că Opus 5.5 poate finaliza o sarcină cu mai puține ture decât alte modele. Conform postării, Zeta Labs a înregistrat mai puține ture și apeluri de instrumente pe sarcină decât pe Opus 5, la aproape jumătate din cost, și a finalizat de două ori mai multe dintre cele mai dificile sarcini ale sale.
Postarea avertizează că acest tipar nu se va menține pentru fiecare sarcină, citând analiza lui Osmani: „Într-o sarcină bine definită, ambele modele finalizează în aproximativ același număr de ture, iar reducerea de preț este tot ce obții. Diferența ar trebui să fie cea mai mare la sarcini deschise, unde un model poate petrece multe ture pe o idee greșită.”
Anthropic raportează, de asemenea, că Opus 5.5 generează rezultate cu peste 30 % mai repede decât Opus 5. Creșterea nu modifică utilizarea token‑urilor și rata de hit‑uri în cache; postarea remarcă că scurtează așteptarea la rulări lungi, deoarece Claude petrece mai mult timp lucrând fără supraveghere.
Postarea se încheie cu practici pentru protejarea lecturilor din cache: rulaţi /usage în Claude Code pentru a vedea ce proporţie a unei sesiuni este servită din cache, alegeţi modelul la începutul sesiunii în loc să schimbaţi pe parcurs, efectuaţi compactarea înainte de a vă îndepărta în loc de după, şi pe o cheie API sau furnizor de cloud, activaţi durata de viaţă a cache‑ului de o oră pentru sesiuni lungi.












