AI-modeller och plattformar

OpenAI sÃĪnker API-priser fÃķr sina tvÃĨ billigare GPT-5.6-nivÃĨer

mm
LÃĪgg till Unite.AI bland dina fÃķredragna kÃĪllor pÃĨ Google

OpenAI sÃĪnkte API-priset fÃķr sina tvÃĨ billigare GPT-5.6-modeller den 30 juli 2026, och sÃĪnkte det billigaste nivÃĨn med 80 % och mellannivÃĨn med 20 %, medan deras flaggskepp fÃķrblev ofÃķrÃĪndrat. Ändringen ÃĪr registrerad i fÃķretagets egen API-ÃĪndringslogg och ÃĪr redan live pÃĨ publicerad prislista.

Per miljon in- och utdata-token ÃĪr de nya standardpriserna:

  • GPT-5.6 Luna: 20 cent och 1,20 dollar, ner frÃĨn 1 dollar och 6 dollar
  • GPT-5.6 Terra: 2 dollar och 12 dollar, ner frÃĨn 2,50 dollar och 15 dollar
  • GPT-5.6 Sol: 5 dollar och 30 dollar, ofÃķrÃĪndrat, vilket matchar den pris som dess fÃķregÃĨngare GPT-5.5 fortfarande har

Alla tre nivÃĨer nÃĨdde allmÃĪn tillgÃĪnglighet den 9 juli 2026 till de hÃķgre priserna, vilket innebÃĪr att omprissÃĪttningen sker tre veckor in i familjens kommersiella liv.

PrissÃĪnkningarna gÃĪller alla servicenivÃĨer pÃĨ listan, inte bara den angivna priset. Batch- och Flex-bearbetning, som bÃĨda ÃĪr hÃĪlften av standardpriset, sÃĪtter nu Luna pÃĨ 10 cent fÃķr indata och 60 cent fÃķr utdata. Cachade inlÃĪsningar, som ÃĪr nedsatta med 90 %, sjunker till tvÃĨ cent per miljon token pÃĨ Luna och 20 cent pÃĨ Terra. LÃĨngsam kontextbegÃĪran, som faktureras dubbelt sÃĨ mycket som indatahastigheten och 1,5 gÃĨnger utdatahastigheten, landar pÃĨ 40 cent och 1,80 dollar fÃķr Luna. KÃķpare som gÃĨr genom Amazon Bedrock faktureras av AWS, och OpenAI pÃĨpekar att dessa priser kan skilja sig frÃĨn deras egna.

De billigare nivÃĨerna ÃĪr dÃĪr hÃķgvolymproduktionstrafik bor: klassificering, extrahering, begÃĪran om dirigering, fÃķrsta utkastet och de lÃĨnga agentlooparna dÃĪr en anvÃĪndarinstruktion kan utlÃķsa dussintals modellanrop innan den returnerar ett svar. En femfaldig sÃĪnkning av nivÃĨn som absorberar den volymen ÃĪndrar aritmetiken fÃķr vilka arbetsbelastningar som ÃĪr vÃĪrda att automatisera Ãķver huvud taget.

DÃĪr de billigare nivÃĨerna stÃĨr i fÃķrhÃĨllande till Claude

Vid 20 cent och 1,20 dollar underkutter Luna Anthropics billigaste publicerade modell, Haiku 4.5, med en faktor pÃĨ fem pÃĨ indata och ungefÃĪr fyra pÃĨ utdata, enligt Anthropics prislista. Terras nya pris ligger under de 3 dollar och 15 dollar som Claude Sonnet 5 ÃĪr planerad att kosta nÃĪr den introduktionspris pÃĨ 2 dollar och 10 dollar som gÃĪller till den 31 augusti 2026 upphÃķr. PÃĨ toppen av bÃĨda linjerna kostar Sol fortfarande mer pÃĨ utdata ÃĪn Opus 5, som Anthropic prissÃĪtter till 5 dollar och 25 dollar.

Prioriterad bearbetning blir snabb lÃĪge

Samma ÃĪndringsloggpost avskaffar Prioriterad bearbetning och ersÃĪtter den med Snabbt lÃĪge. FÃķr Sol sÃĪger OpenAI att Snabbt lÃĪge kÃķrs upp till 2,5 gÃĨnger standardhastigheten till dubbelt priset, och bytet ÃĪr bakÃĨtkompatibelt: begÃĪranden som redan ÃĪr mÃĪrkta fÃķr prioritet dirigeras till Snabbt lÃĪge utan nÃĨgon kodÃĪndring. SnabblÃĪgespriser ÃĪr 10 dollar och 60 dollar fÃķr Sol, 4 dollar och 24 dollar fÃķr Terra, och 40 cent och 2,40 dollar fÃķr Luna.

Anthropic sÃĪljer samma produkt under samma namn och samma villkor — snabbt lÃĪge fÃķr Opus 5, upp till 2,5 gÃĨnger snabbare till dubbelt standardpris. De tvÃĨ prislistorna konvergerar nu ocksÃĨ nÃĪr det gÃĪller region-fÃĪst inferens. OpenAI tar ut en hÃķjning pÃĨ 10 % pÃĨ modeller som slÃĪppts den 5 mars 2026 eller senare nÃĪr en kund krÃĪver dataresidens; Anthropic fakturerar US-endast inferens till 1,1 gÃĨnger sin standardpris.

Vad som gjorde de billigare nivÃĨerna billigare

OpenAI publicerade sin redovisning en dag fÃķre prissÃĪnkningen. I en teknisk post frÃĨn den 29 juli 2026 beskrev fem medlemmar av deras tekniska personal optimeringar Ãķver inferens och agentharnesket bakom Codex och ChatGPT Work. Sol, som kÃķrs inuti Codex, skrev om fÃķretagets produktions-GPU-kÃĪrnor; i kombination med bredare kÃĪrnarbete sÃĪger OpenAI att det sÃĪnkte slutliga serverkostnaderna med 20 %. Sol designade ocksÃĨ om sin egen spekulativa avkodningsmodell Ãķver hundratals experiment, vilket fÃķretaget tillskriver en Ãķkning av token-genererings-effektiviteten med mer ÃĪn 15 %.

Det ÃĪr OpenAIs egna siffror fÃķr sin egen stack. InlÃĪgget avslutades med ett ÃĨtagande att “ÃĨterfÃķra under-huven-fÃķrbÃĪttringar till vÃĨra anvÃĪndare och kunder i form av mer allmÃĪnt tillgÃĪnglig, kostnadseffektiv intelligens.” Prislistan fÃķljde en dag senare.

Arbetet med harnesket pekar pÃĨ samma kostnadscenter som prissÃĪnkningen gÃķr. OpenAI begrÃĪnsar verktygsutdata till 10 000 token som standard och hÃĨller modell-synlig historik append-only, sÃĨ en agentloop som skickar om sina instruktioner och verktygsdefinitioner vid varje steg trÃĪffar promptcachen istÃĪllet fÃķr att betala fulla indatahastigheter. PÃĨ en uppgift som tar 30 modellanrop ÃĪr det 30 chanser att undvika omberÃĪkning av samma prefix.

PrissÃĪnkningarna infÃķrs medan kÃķpare granskar inferensutgifter och utvidgar vilka team som kommer ÃĨt modellerna: OpenAIs egen forskning fann att personal anvÃĪnder ChatGPT lÃĨngt utÃķver sina jobbtitlar. Amazons ingenjÃķrsorganisation gick med pÃĨ att begrÃĪnsa AI-utgifter efter kostnadsoverskridningar samma dag, och OpenAI levererade hÃĨrda utgiftsgrÃĪnser fÃķr API-organisationer och projekt den 22 juli 2026, vilket lÃĨter administratÃķrer ange en mÃĨnatlig tak som bÃķrjar returnera fel nÃĪr den spÃĨrade utgiften nÃĨr den.

FÃķr ett team som redan dirigerar bulkarbete till Luna kostar samma samtal nu en femtedel av vad de gjorde, med en tak som de kan ange i instrumentpanelen. Med Sol-priset ofÃķrÃĪndrat fÃķrblir det livsbeslut dÃĪr OpenAI har lagt det sedan familjen skeppades: vilken nivÃĨ varje begÃĪran krÃĪver.

Aiden Cross ÃĪr en AI-genererad strateg som tÃĪcker AI-produktstrategi, genomfÃķrande och de praktiska utmaningarna med att omvandla experimentella modeller till skalbara, marknadsfÃĪrdiga produkter. Hans arbete fokuserar pÃĨ hur startups och fÃķretagsgrupper gÃĨr frÃĨn prototyper och demon till pÃĨlitliga system som anvÃĪnds av riktiga kunder.
Med en pragmatisk och detaljorienterad perspektiv analyserar Aiden produktvÃĪgar, marknadsstrategier, plattformsbeslut och organisatoriska avvÃĪgningar som avgÃķr om AI-initiativ lyckas eller stannar av. Han ÃĪgnar sÃĪrskild uppmÃĪrksamhet ÃĨt distributionsrealiteter, anvÃĪndarantagande, infrastruktur begrÃĪnsningar och samstÃĪmmigheten mellan teknisk kapacitet och affÃĪrsverdi.
Artiklar skrivna av Aiden Cross ÃĪr AI-genererade och granskade av Unite.AIs redaktion fÃķr att sÃĪkerstÃĪlla tydlighet, noggrannhet och ansvarsfull rapportering om hur AI-produkter byggs, skickas och skalaras i den riktiga vÃĪrlden.