AI-modeller og platforme
OpenAI reducerer API-priser på sine to billigere GPT-5.6-niveauer

OpenAI har reduceret API-prisen på sine to billigere GPT-5.6-modeller den 30. juli 2026, hvor den billigste model blev reduceret med 80% og midterste niveau blev reduceret med 20%, mens den toplacering blev ladet uændret. Ændringen er logget i virksomhedens egen API-ændringslog og er allerede live på offentliggjort prisliste.
Pr. million ind- og udgangstokens er standardtaksterne nu:
- GPT-5.6 Luna: 20 cent og 1,20 dollar, ned fra 1 dollar og 6 dollar
- GPT-5.6 Terra: 2 dollar og 12 dollar, ned fra 2,50 dollar og 15 dollar
- GPT-5.6 Sol: 5 dollar og 30 dollar, uændret, svarende til den pris, som dens forgænger GPT-5.5 stadig har
Alle tre niveauer nåede generel tilgængelighed den 9. juli 2026 til de højere priser, hvilket betyder, at omprisningen sker tre uger inde i produktfamiliens kommercielle liv.
Reducerne går gennem alle serviceniveauer på listen, ikke kun overskriftsprisen. Batch- og Flex-behandling, der begge er halv pris i forhold til standardprisen, sætter nu Luna til 10 cent ind og 60 cent ud. Cachede indlæsninger, der er rabatteret med 90%, falder til to cent pr. million token på Luna og 20 cent på Terra. Lange-kontekstforespørgsler, der faktureres til dobbelt indgangsrate og 1,5 gang udgangsrate, lander på 40 cent og 1,80 dollar for Luna. Købere, der går gennem Amazon Bedrock, faktureres af AWS, og OpenAI bemærker, at disse priser kan afvige fra deres egne.
De billigere niveauer er, hvor højvolumenproduktionstrafikken bor: klassificering, udtræk, anmodningsrute, førsteudkast og de lange agentløkker, hvor en brugerinstruks kan udløse dusinvis af modelanmodninger, før den returnerer et svar. En femdobling af reduktionen på niveauet, der absorberer denne volumen, ændrer aritmetikken på, hvilke arbejdsbelastninger der er værd at automatisere overhovedet.
Hvor de billigere niveauer sidder i forhold til Claude
Ved 20 cent ind og 1,20 dollar ud, underkutter Luna Anthropics billigste offentliggjorte model, Haiku 4.5, med en faktor på fem på indgang og omtrent fire på udgang, ifølge Anthropics prisliste. Terras nye pris ligger under de 3 dollar og 15 dollar, som Claude Sonnet 5 er planlagt til at koste, når dens introduktionspris på 2 dollar og 10 dollar udløber den 31. august 2026. Øverst i begge linjer koster Sol stadig mere på udgang end Opus 5, som Anthropic priser til 5 dollar og 25 dollar.
Prioritetsbehandling bliver til Fast-mode
Den samme ændringslogning pensionerer Prioritetsbehandling og erstatter den med Fast-mode. For Sol siger OpenAI, at Fast-mode kører op til 2,5 gange standardhastighed til dobbelt pris, og skiftet er bagudkompatibelt: anmodninger, der allerede er markeret til prioritet, routeres til Fast-mode uden en kodeændring. Fast-mode-priser er 10 dollar og 60 dollar for Sol, 4 dollar og 24 dollar for Terra og 40 cent og 2,40 dollar for Luna.
Anthropic sælger det samme produkt under samme navn og samme vilkår – fast-mode for Opus 5, op til 2,5 gange hurtigere til dobbelt standardpris. De to prislisteer konvergerer nu også på region-fastsat inference. OpenAI opkræver en 10%-forhøjelse på modeller, der er udgivet på eller efter den 5. marts 2026, når en kunde kræver dataresidens; Anthropic fakturerer US-kun-inference til 1,1 gange deres standardpris.
Hvad gjorde de billigere niveauer billigere
OpenAI offentliggjorde sin regnskab en dag før reduktionen. I en teknisk artikel den 29. juli 2026 beskrev fem medlemmer af deres tekniske personale optimeringer på tværs af inference og agent-harness bag Codex og ChatGPT Work. Sol, der kører inden for Codex, omskrev virksomhedens produktions-GPU-kerner; kombineret med bredere kernel-arbejde, siger OpenAI, at det reducerede slut-endeserveringsomkostningerne med 20%. Sol genopdesignede også sin egen spekulativ-dekodningsdraft-model på tværs af hundredvis af eksperimenter, hvilket virksomheden krediterer med at øge token-genererings-effektiviteten med mere end 15%.
Det er OpenAIs egne tal for deres egen stack. Artiklen sluttede med en løfte om at videregive “under-huden-forbedringer tilbage til vores brugere og kunder i form af mere tilgængelig, omkostningseffektiv intelligens.” Prislisten fulgte dagen efter.
Arbejdet med harness peger på samme omkostningscenter, som prisreduktionen gør. OpenAI begrænser værktøjsoutput til 10.000 token som standard og holder model-synlig historik append-only, så en agent-løkke, der gensender sine instruktioner og værktøjsdefinitioner ved hver skridt, rammer prompt-cachen i stedet for at betale fuld indgangsrate. På en opgave, der tager 30 model-anmodninger, er det 30 chancer for at undgå at regne samme præfiks.
Reducerne lander, mens købere er i gang med at gennemgå inference-omkostninger og udvide, hvilke hold rører modellerne: OpenAIs egen forskning fandt, at medarbejdere brugte ChatGPT langt ud over deres jobtitler. Amazons tekniske organisation gik til at begrænse AI-udgifter efter omkostningsoverskridelser samme dag, og OpenAI leverede hårde udgiftsgrænser for API-organisationer og projekter den 22. juli 2026, hvilket giver administratorer mulighed for at sætte en månedlig loft, der starter med at returnere fejl, når den registrerede udgift når det.
For et hold, der allerede routerer bulk-arbejde til Luna, koster samme anmodninger nu en femtedel af, hvad de gjorde, med et loft, de kan sætte i dashboardet. Med Sols pris uændret forbliver den levende beslutning, hvor OpenAI har sat den, siden familien blev udskibet: hvilket niveau hver anmodning kræver.












