AI-modeller og plattformer

Anthropic knytter Claude Opus 5.5-prising til lengre kodingsøkter

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Anthropic rapporterte 24. september 2026 at Claude Code-økter har blitt lengre og mer kontekstkrevende de siste seks månedene, og beskriver i et innlegg på Claude-bloggen hvordan pris- og cache-mekanikken i Claude Opus 5.5 håndterer denne endringen. Selskapet anslår at driftskostnaden for Opus 5.5 er omtrent 40 % lavere enn for Opus 5 ved en typisk token-fakturert arbeidsbelastning.

Seks måneder med Claude Code-bruksdata

Innlegget, skrevet av Michael Segner, baserer seg på samlede bruksdata fra mars til september 2026. Antallet prompts per økt holdt seg stabilt, rapporterer innlegget, mens arbeidet i hver prompt vokste: modellen arbeider nå 3,3 ganger lenger per prompt og gjør mer enn 40 % flere modellkall per prompt, og avbrudd falt med 68 %. Utviklere kobler nå til en verktøyserver eller bruker en ferdighet omtrent dobbelt så ofte, og limer inn tekst i prompts en tredjedel så ofte.

Mengden kontekst i hver forespørsel økte 2,6 ganger i perioden, og forholdet mellom input- og output‑tokener gikk fra 189:1 til 324:1. Anthropic tolker tallene som at utviklere sikter mot en modell som arbeider lenger og er bedre informert for større, mer åpne oppgaver, og sier at besparelsene med Opus 5.5 er størst for nettopp de lengre, høy‑kontekst‑øktene når bruken faktureres per token.

Analysen bygger på Anthropics lansering av Claude Opus 5.5, som kom med lavere priser enn Opus 5. Der lanseringen fastsatte prisene, undersøker innlegget fra 24. september og en tilhørende analyse publisert 22. september 2026 av Addy Osmani hva disse prisene betyr for reelle Claude Code‑arbeidsbelastninger.

Tokenpriser og reduksjon av cache‑lesning

For bruk fakturert per token reduserte Anthropic prisene på input‑ og output‑tokener med 20 % og kutte prisen for å lese en cache‑token med 60 %. Selskapet sier at reduksjonen i cache‑lesning har størst betydning fordi cache‑lesninger utgjør mesteparten av kostnaden for agent‑ og kodearbeid, og oppgir at per publiseringstidspunkt koster en cache‑token i Opus 5.5 kun en femtedel av kostnaden for konkurrerende modeller og overgår dem.

Osmanis tilhørende analyse oppgir Opus 5.5 sine API‑listepriser til $4 per million input‑token, $20 per million output‑token og $0,20 per million cache‑lesninger. Til disse prisene koster en cache‑lesning 5 % av en fersk input‑token, mens skriving til cachen koster 1,25 ganger input‑prisen for en fem‑minutters cache og to ganger input‑prisen for en én‑times cache, med hver treff som fornyer levetiden gratis. På Pro‑, Max‑ eller Team‑planer overføres den lavere Opus 5.5‑prisen til plan‑grensene, slik at de går omtrent 25 % lenger enn på Opus 5; den ekstra cache‑lesningsrabatten gjelder kun for API‑priser.

Utnytt endringer som beskytter cachen

Selv om konteksten per forespørsel økte med omtrent 2,6 ganger, falt andelen input som gikk utenom cachen med mer enn 50 % i løpet av de seks månedene, rapporterer innlegget. Det krediterer en rekke Claude Code‑endringer som reduserer utilsiktede cache‑brudd, fra små forstyrrelser som en innloggingsoppfriskning til større som å legge til instruksjoner midt i samtalen eller laste inn verktøy på forespørsel. På Opus 5.5 og Fable 5.1 kan utviklere også endre innsatsnivåer midt i økten uten å tilbakestille cachen.

Den offisielle prompt-caching-dokumentasjonen angir at innsatsnivå‑atferden gjelder med en API‑nøkkel eller et Claude‑abonnement, og ikke på Amazon Bedrock, Google Clouds Agent Platform eller en Claude‑apps‑gateway, heller ikke når CLAUDECODEDISABLEEXPERIMENTALBETAS‑flagget er aktivert eller en organisasjon har en HIPAA‑konfigurasjon.

Utviklere med API‑nøkler og sky‑leverandører kan nå sette en cache‑levetid på én time, noe abonnenter allerede hadde. Dokumentasjonen viser standardene: én time for hovedsamtalen på et Claude‑abonnement innen plan‑bruk, og fem minutter på brukskreditter, API‑nøkler eller sky‑leverandører. promptCacheTtl‑innstillingen eller CLAUDECODEPROMPTCACHETTL‑miljøvariabelen velger den lengre levetiden, og begge kontrollene krever Claude Code v2.1.242 eller nyere.

Forgrenede underagenter starter nå fra den overordnede øktens cache i stedet for å måtte betale for å behandle samme kontekst på nytt. Dokumentasjonen forklarer at en forgrening overtar den overordnede system‑prompten, verktøysettet og hele samtalehistorikken, slik at dens innledende forespørsel leser direkte fra den overordnede cachen.

Færre turer per oppgave

Anthropic rapporterer at Opus 5.5 kan fullføre en oppgave i færre turer enn andre modeller. Ifølge innlegget registrerte Zeta Labs færre turer og verktøykall per oppgave enn på Opus 5, til nesten halv pris, og fullførte dobbelt så mange av sine vanskeligste oppgaver.

Innlegget advarer om at mønsteret ikke vil holde for hver oppgave, og siterer Osmanis analyse: “På en godt avgrenset oppgave fullfører begge modellene med omtrent samme antall turer, og prisreduksjonen er alt du får. Gapet bør være størst på åpne oppgaver, hvor en modell kan bruke mange turer på feil idé.”

Anthropic rapporterer også at Opus 5.5 produserer output mer enn 30 % raskere enn Opus 5. Gevinsten påvirker ikke token‑bruk eller cache‑treffrate; innlegget bemerker at den forkorter ventetiden på lange kjøringer ettersom Claude bruker mer tid på å arbeide uten tilsyn.

Innlegget avslutter med praksiser for å beskytte bufrede lesninger: kjør /usage i Claude Code for å se hvilken andel av en økt som blir servert fra cache, velg modellen når en økt starter i stedet for å bytte underveis, kjør komprimering før du går bort i stedet for etterpå, og på en API‑nøkkel eller cloud provider, aktiver en‑times cachelevetid for lange økter.

Jonas Reeve er en AI-generert analytiker hos Unite.AI, som fokuserer på kognitiv AI, kunstig generell intelligens (AGI) og de teoretiske grunnlagene for maskinintelligens. Hans arbeid utforsker hvordan læring, resonnering, minne og abstraksjon oppstår i både biologiske og kunstige systemer, og trekker sammenheng mellom moderne AI-arkitekturer og langvarige spørsmål i kognitiv vitenskap og filosofi om sinn.

Med en konseptuell og reflektert tilnærming, undersøker Jonas rammer som resonneringsmodeller, agente systemer, emergent kognisjon og aligneringsteori, med mål om å klargjøre hva fremgang mot AGI faktisk betyr - og hva det ikke betyr. I stedet for å jage tidsfrister eller hype, legger han vekt på første prinsipper, konseptuell rigor og grensene for nåværende modeller.

Artikler skrevet av Jonas Reeve er AI-generert og gjennomgått av Unite.AIs redaksjonelle team for å sikre nøyaktighet, klarhet og ansvarlig diskusjon av avanserte AI-konsepter.