AI-modellen en platforms
Anthropic koppelt de prijzen van Claude Opus 5.5 aan langere coderingssessies

Anthropic meldde op 24 september 2026 dat Claude Code‑sessies de afgelopen zes maanden langer en contextzwaarder zijn geworden, en beschrijft in een bericht op de Claude‑blog hoe de prijs‑ en cachemechanismen van Claude Opus 5.5 die verschuiving aanpakken. Het bedrijf stelt dat de operationele kosten van Opus 5.5 ongeveer 40 % lager liggen dan die van Opus 5 voor een typische token‑gefactureerde werklast, volgens eigen schatting.
Zes maanden Claude Code‑gebruikgegevens
Het bericht, geschreven door Michael Segner, maakt gebruik van geaggregeerde gebruiksgegevens over maart tot en met september 2026. Het aantal prompts per sessie bleef gelijk, meldt het bericht, terwijl het werk binnen elke prompt groeide: het model werkt nu 3,3 keer langer per prompt en maakt meer dan 40 % meer modelaanroepen per prompt, en onderbrekingen daalden met 68 %. Ontwikkelaars verbinden nu ongeveer twee keer zo vaak een toolserver of gebruiken een vaardigheid, en plakken tekst in prompts een derde zo vaak.
De hoeveelheid context in elk verzoek groeide gedurende de periode 2,6‑maal, en de verhouding input‑naar‑output‑tokens verschuift van 189:1 naar 324:1. Anthropic interpreteert de cijfers als ontwikkelaars die een langer werkende, beter geïnformeerde model richten op grotere, meer open‑ended taken, en stelt dat de besparingen met Opus 5.5 het grootst zijn voor precies die langere, hogere‑contextsessies wanneer gebruik per token wordt gefactureerd.
De analyse bouwt voort op de release van Claude Opus 5.5 door Anthropic, die met lagere prijzen dan Opus 5 kwam. Waar de lancering de prijzen vaststelde, onderzoeken het bericht van 24 september en een begeleidende analyse, gepubliceerd op 22 september 2026 door Addy Osmani, wat die prijzen betekenen voor echte Claude Code‑werkbelastingen.
Tokenprijzen en de verlaging van cache‑lezen
Voor gebruik dat per token wordt gefactureerd, verlaagde Anthropic de input‑ en output‑tokenprijzen met 20 % en verlaagde de prijs voor het lezen van een gecachte token met 60 %. Het bedrijf stelt dat de verlaging van cache‑lezen het zwaarste weegt omdat cache‑lezingen het grootste deel van de kosten van agentisch en coderingswerk uitmaken, en meldt dat op het moment van publicatie een gecachte token op Opus 5.5 slechts één vijfde kost van concurrerende modellen en deze overtreft.
De begeleidende analyse van Osmani vermeldt de API‑lijstprijzen van Opus 5.5 op $4 per miljoen input‑tokens, $20 per miljoen output‑tokens en $0,20 per miljoen cache‑lezingen. Tegen die prijzen kost een gecachte lezing 5 % van een verse input‑token, terwijl schrijven naar de cache 1,25‑maal de inputprijs kost voor een cache van vijf minuten en twee‑maal de inputprijs voor een cache van één uur, waarbij elke hit de levensduur gratis verlengt. Op Pro-, Max‑ of Team‑plannen wordt de lagere Opus 5.5‑prijs doorgegeven aan de plannlimieten, zodat ze ongeveer 25 % verder gaan dan op Opus 5; de extra korting op cache‑lezingen geldt alleen voor API‑prijzen.
Benut wijzigingen die de cache beschermen
Zelfs toen de context per verzoek ongeveer 2,6‑maal toenam, daalde het aandeel input dat de cache mist met meer dan 50 % gedurende de zes‑maanden‑periode, meldt het bericht. Het schrijft een reeks Claude Code‑wijzigingen toe die accidentele cache‑onderbrekingen verminderen, variërend van kleine verstoringen zoals een login‑verversing tot grotere, zoals het toevoegen van instructies halverwege een gesprek of het on‑demand laden van tools. Op Opus 5.5 en Fable 5.1 kunnen ontwikkelaars bovendien inspanningsniveaus halverwege een sessie wijzigen zonder de cache te resetten.
De officiële prompt‑caching‑documentatie specificeert dat het gedrag van inspanningsniveaus geldt met een API‑sleutel of een Claude‑abonnement, en niet op Amazon Bedrock, Google Cloud’s Agent Platform, of een Claude‑apps‑gateway, noch wanneer de CLAUDECODEDISABLEEXPERIMENTALBETAS‑vlag is ingesteld of een organisatie een HIPAA‑configuratie heeft.
Ontwikkelaars met API‑sleutels en cloud‑providers kunnen nu een cache‑levensduur van één uur instellen, wat abonnees al hadden. De documentatie toont de standaardinstellingen: één uur voor het hoofdgesprek op een Claude‑abonnement binnen het plan‑gebruik, en vijf minuten voor gebruik‑credits, API‑sleutels of cloud‑providers. De promptCacheTtl‑instelling of de CLAUDECODEPROMPTCACHETTL‑omgevingsvariabele selecteert de langere levensduur, en beide besturingselementen vereisen Claude Code v2.1.242 of hoger.
Geforkte subagents beginnen nu vanuit de cache van de bovenliggende sessie in plaats van te betalen om dezelfde context opnieuw te verwerken. De documentatie legt uit dat een fork de systeemprompt, toolset en volledige gesprekshistorie van de bovenliggende sessie overneemt, zodat het eerste verzoek rechtstreeks uit de cache van de bovenliggende sessie wordt gelezen.
Minder beurten per taak
Anthropic meldt dat Opus 5.5 een taak in minder beurten kan voltooien dan andere modellen. Volgens het bericht registreerde Zeta Labs minder beurten en tool‑aanroepen per taak dan Opus 5, tegen bijna de helft van de kosten, en voltooide tweemaal zoveel van zijn moeilijkste taken.
Het bericht waarschuwt dat het patroon niet voor elke taak geldt, met een citaat uit analyse van Osmani: “Bij een goed afgebakende taak voltooien beide modellen ongeveer hetzelfde aantal beurten, en de prijsverlaging is alles wat je krijgt. Het verschil zou het grootst moeten zijn bij open‑ended taken, waar een model veel beurten kan besteden aan een verkeerd idee.”
Anthropic meldt ook dat Opus 5.5 output meer dan 30 % sneller produceert dan Opus 5. De winst laat het token‑gebruik en de cache‑hit‑ratio ongewijzigd; het bericht merkt op dat het de wachttijd bij lange runs verkort omdat Claude meer tijd onbemand werkt.
Het bericht sluit af met praktijken voor het beschermen van gecachte reads: voer /usage uit in Claude Code om te zien welk deel van een sessie uit de cache wordt bediend, kies het model bij het starten van een sessie in plaats van halverwege te wisselen, voer compactie uit voordat je wegstapt in plaats van daarna, en schakel bij een API‑sleutel of cloudprovider de cache‑levensduur van één uur in voor lange sessies.












