AI-modeller og platforme
Anthropic knytter Claude Opus 5.5-priser til længere kodningssessioner

Anthropic rapporterede den 24. september 2026, at Claude Code-sessioner er blevet længere og mere konteksttunge i løbet af de sidste seks måneder, og beskriver i et indlæg på Claude-bloggen, hvordan Claude Opus 5.5’s pris- og cache‑mekanismer håndterer denne ændring. Virksomheden angiver, at driftsomkostningerne for Opus 5.5 er cirka 40 % lavere end for Opus 5 for en typisk token‑baseret arbejdsbelastning, ifølge deres eget estimat.
Seks måneders Claude Code‑brugsdata
Indlægget, skrevet af Michael Segner, baserer sig på samlede brugsdata fra marts til september 2026. Antallet af forespørgsler pr. session holdt sig stabilt, rapporterer indlægget, mens arbejdet inden for hver forespørgsel voksede: modellen arbejder nu 3,3 gange længere pr. forespørgsel og udfører mere end 40 % flere model‑kald for hver, og afbrydelser faldt med 68 %. Udviklere forbinder nu en værktøjserver eller bruger en funktion omtrent dobbelt så ofte, og indsætter tekst i forespørgsler en tredjedel så ofte.
Mængden af kontekst i hver anmodning voksede 2,6‑fold i perioden, og forholdet mellem input‑ og output‑tokens steg fra 189:1 til 324:1. Anthropic fortolker tallene som at udviklere sigter efter en længere‑arbejdende, bedre informeret model til større, mere åbne opgaver, og siger, at besparelserne ved Opus 5.5 er størst netop for de længere sessioner med højere kontekst, når forbruget faktureres pr. token.
Analysen bygger på Anthropics udgivelse af Claude Opus 5.5, som kom med lavere priser end Opus 5. Hvor lanceringen fastsatte priserne, undersøger indlægget den 24. september samt en tilhørende analyse offentliggjort den 22. september 2026 af Addy Osmani, hvad disse priser betyder for reelle Claude Code‑arbejdsbelastninger.
Token‑priser og nedsættelse af cache‑læsning
For forbrug faktureret pr. token reducerede Anthropic priserne på input‑ og output‑tokens med 20 % og sænkede prisen for at læse en cache‑token med 60 %. Virksomheden siger, at nedsættelsen af cache‑læsning har størst betydning, fordi cache‑læsninger udgør størstedelen af omkostningerne ved agentbaseret og kodningsarbejde, og at pr. udgivelse koster en cache‑token på Opus 5.5 kun en femtedel af prisen for konkurrerende modeller og overgår dem.
Osmanis tilhørende analyse angiver Opus 5.5’s API‑listepriser til $4 pr. million input‑tokens, $20 pr. million output‑tokens og $0,20 pr. million cache‑læsninger. Til disse priser koster en cache‑læsning 5 % af en frisk input‑token, mens skrivning til cachen koster 1,25 × inputprisen for en fem‑minutters cache og to gange inputprisen for en én‑times cache, hvor hvert hit fornyer levetiden gratis. På Pro-, Max‑ eller Team‑planer videregives den lavere Opus 5.5‑pris til plan‑grænserne, så de går ca. 25 % længere end på Opus 5; den ekstra cache‑læsningsrabat gælder kun for API‑priser.
Udnyt ændringer, der beskytter cachen
Selvom konteksten pr. anmodning steg med cirka 2,6‑fold, faldt andelen af input, der missede cachen, med mere end 50 % i løbet af det seks‑måneders vindue, rapporterer indlægget. Det tilskriver en række Claude Code‑ændringer, der reducerer utilsigtede cache‑afbrydelser, herunder små forstyrrelser som en login‑opdatering og større som tilføjelse af instruktioner midt i samtalen eller indlæsning af værktøjer efter behov. På Opus 5.5 og Fable 5.1 kan udviklere også ændre indsatsniveauer midt i sessionen uden at nulstille cachen.
Den officielle prompt‑caching‑dokumentation angiver, at indsatsniveau‑adfærden gælder med en API‑nøgle eller et Claude‑abonnement, men ikke på Amazon Bedrock, Google Clouds Agent Platform eller en Claude‑apps‑gateway, ej heller når flaget CLAUDECODEDISABLEEXPERIMENTALBETAS er sat, eller når en organisation har en HIPAA‑konfiguration.
Udviklere med API‑nøgler og cloud‑udbydere kan nu indstille en cache‑levetid på én time, som abonnenter allerede havde. Dokumentationen viser standardindstillingerne: én time for hovedsamtalen på et Claude‑abonnement inden for planforbrug, og fem minutter for forbrugs‑kreditter, API‑nøgler eller cloud‑udbydere. promptCacheTtl‑indstillingen eller miljøvariablen CLAUDECODEPROMPTCACHETTL vælger den længere levetid, og begge kontroller kræver Claude Code v2.1.242 eller senere.
Forgrenede underagenter starter nu fra forældresessionens cache i stedet for at betale for at genbehandle den samme kontekst. Dokumentationen forklarer, at en forgrening overtager forælderens system‑prompt, værktøjssæt og komplette samtalehistorik, så dens indledende anmodning læses direkte fra forælderens cache.
Færre runder pr. opgave
Anthropic rapporterer, at Opus 5.5 kan fuldføre en opgave i færre runder end andre modeller. Ifølge indlægget registrerede Zeta Labs færre runder og værktøjskald pr. opgave end på Opus 5, til næsten halvdelen af omkostningerne, og afsluttede dobbelt så mange af deres sværeste opgaver.
Indlægget advarer om, at mønsteret ikke vil gælde for hver opgave, og citerer Osmani’s analyse: “På en veldefineret opgave afslutter begge modeller efter omtrent samme antal runder, og prisnedsættelsen er alt, du får. Forskellen bør være størst på åbne opgaver, hvor en model kan bruge mange runder på den forkerte idé.”
Anthropic rapporterer også, at Opus 5.5 leverer output mere end 30 % hurtigere end Opus 5. Gevinsten påvirker hverken token‑forbrug eller cache‑hit‑rate; indlægget bemærker, at den forkorter ventetiden på lange kørsler, da Claude bruger mere tid på at arbejde uden opsyn.
Posten afslutter med praksisser for at beskytte cache‑læsninger: kør /usage i Claude Code for at se, hvilken andel af en session der leveres fra cachen, vælg modellen når en session starter i stedet for at skifte undervejs, udfør komprimering før du går væk i stedet for efterfølgende, og på en API‑nøgle eller cloud‑udbyder, aktivér den én‑times cache‑levetid for lange sessioner.












