AI-modeller og platforme
Amazon-ingeniører begrænser AI-udgifter efter overskridelser

Amazon’s (AMZN ) ingeniørteams har fundet eksempler, hvor overførsel af arbejde fra håndskrevet kode til AI-modeller har overskredet projektbudgetterne, herunder 1,8 millioner dollars brugt på at køre Anthropics Claude Sonnet på et job, der aldrig blev sendt. Senioringeniører præsenterede disse eksempler for medarbejderne på et internt møde den 28. juli 2026 og beskrev resultaterne som “katastrofalt dyre”, ifølge Financial Times, der citerer flere personer, der er bekendt med præsentationen. De fortalte kollegaerne, at de nu bygger automatiske sikkerhedsforanstaltninger for at begrænse, hvad fremtidige projekter kan bruge.
Det største eksempel svarede til at matche forfatteroptegnelser mod produktlistinger på Amazons detailhandelsside. Udgifterne oversteg budgettet med 860%, tog fem måneder at dukke op og fejlede alligevel. To mindre tilfælde blev vist ved siden af: omkring 541.000 dollars i uventede omkostninger på en samling af finansielle revisionsværktøjer og 134.000 dollars på arbejde for at forbedre leveringstider på tværs af Amazons logistiknetværk, fanget efter mere end to uger.
Amazon sagde, at det “eksperimenterer, lærer og forbedrer” måden, det bruger teknologien på, herunder måden, det driver omkostningseffektivitet på. Virksomheden sagde også, at præsentationen af et par isolerede eksempler som forretning som sædvanligt misrepræsenterer, hvordan dets teams arbejder med AI, og at tilfældene dækkede en lille del af grupperne inden for en virksomhedsarbejdsstyrke på omkring 300.000.
Hvad tokenfakturering gør ved en kodningsfejl
Personale blev fortalt, at fejl, der næsten ikke kostede noget i konventionelle systemer, blev dyre, når en model udførte arbejdet. Årsagen sidder på prissedlen. Anthropic beregner 3 dollars per million indgangstokens og 15 dollars per million udgangstokens for Claude Sonnet 4.5 og 4.6, med Sonnet 5 til en introduktionspris på 2 og 10 dollars, indtil den 31. august 2026, før den går over til samme takst. Ved Sonnets standardindgangspris køber 1,8 millioner dollars på størrelsesordenen 600 milliarder indgangstokens.
En retry-løkke, der gensender samme kontekst, eller en batchjob, der peger på en hel katalog i stedet for et udsnit, kaster ingen undtagelse og crasher intet. Den producerer en faktura, og fakturaen ankommer på en månedlig faktureringscyklus i stedet for i en build-log. Den afstand mellem fejlen og nummeret er, hvad der forvandler en dårlig konfiguration til et fem måneders problem.
Enhedsprisen for fakturering er også ændret. Anthropics dokumentation bemærker, at Claude 4.7 og senere modeller bruger en nyere tokenizer, der producerer omkring 30% flere tokens for samme tekst, så identisk arbejde faktureres højere på en nyere model til samme overskriftsrate. Den bredere skift fra flade sæder til målede tokens er baggrunden: Unite.AI dækkede det, da Claude Fable 5 ankom med en pris som en målet utility og igen som den billige æra for altid-tilgængelige Claude-agenter sluttede.
De kontroller, AWS allerede sælger
Styringsknapperne til dette eksakte problem er offentliggjort på Amazons egen Bedrock-prisside. Batch-inferens kører til halv pris. En Flex-servicetier medfører en 50% rabat på standardprisen, med en Priority-tier til en 75% præmie for arbejde, der kræver hastighed. Intelligent Prompt Routing koster 1 dollar per 1.000 anmodninger og sender enklere prompts til en billigere model i samme familie, hvilket AWS siger kan reducere omkostningerne med op til 30% uden at skade nøjagtigheden.
Anthropics side tilføjer to mere. En cache-læsning er prissat til en tiendedel af den standardindgangspris, så gensendelse af et fast systemprompt eller dokument er den billige del, når cachen er slået til. Og Claude Haiku 4.5 er listet til 1 og 5 dollars per million tokens, en tredjedel af Sonnets takst, hvilket er den største enkeltbesparelse, der er tilgængelig for ethvert hold, der valgte frontier-modellen som standard.
Hver enkelt af disse er en per-arbejdsbeslutning: hvilken model, om konteksten cacheres, om jobbet kører interaktivt eller i en batch-vindue, og hvilken loft den konto har. Leverandører er begyndt at sælge selv kontrollaget, herunder Spectro Clouds PaletteAI-inferens-launchpad, der er rettet mod virksomheder, der forsøger at holde token-omkostningerne nede.
Hvad Amazon ændrer
Amazon har allerede fjernet en incitament, der pegede den forkerte vej. Tidligere i 2026 lukkede det en intern rangering, der rangerede medarbejdernes brug af sin Kiro-udviklerplatform, efter at medarbejderne havde øget deres token-forbrug for at klatre op ad den, en vane, der fik navnet “tokenmaxxing”. De automatiserede sikkerhedsforanstaltninger, som ingeniørerne beskrev, er næste trin, hvor budgetgennemføringen indsættes i implementationsstien i stedet for en månedlig gennemgang.
Skalæren forklarer, hvorfor 1,8 millioner dollars læses som en styrehistorie snarere end en finansielle historie. Amazon forventes at bruge omkring 200 milliarder dollars i kapitaludgifter på tværs af 2026, det meste af det på AI- og datacenter-infrastruktur, mod kvartalsindtægter på omkring 180 milliarder dollars. Virksomheden offentliggør andenkvarterresultater efter lukning den 30. juli 2026, og kapitaludgiftslinjen vil tage det meste af opmærksomheden. Målet, der viser, om sikkerhedsforanstaltningerne virker, er mindre og internt: hvor hurtigt et løbsjob bliver markeret. Forfattermatchningsprojektet satte denne bar på fem måneder, og de automatiserede kontroller er ment til at flytte den ind i bygningen.












