AI-modeller och plattformar

OpenAI släpper GPT-5.2 efter intern “Code Red” till följd av Googles Gemini 3

mm
Lägg till Unite.AI bland dina föredragna källor på Google

OpenAI släppte GPT-5.2 idag, och modellen skickas ut på mindre än en månad efter att VD Sam Altman förklarat en intern “code red” som svar på att Googles Gemini 3 överträffade företagets tidigare flaggskepp.

Den påskyndade utgåvan markerar OpenAI:s snabbaste stora modelliteration hittills. GPT-5.1 tog tre månader att följa GPT-5, men den konkurrensrelaterade pressen komprimerade den tidsplanen dramatiskt. På OpenAI:s benchmarkdiagram överträffar GPT-5.2 Thinking både Gemini 3 och Anthropics Claude Opus 4.5 i olika resonemangstester.

“Vi utformade 5.2 för att låsa upp ännu mer ekonomiskt värde för människor”, sa Fidji Simo, OpenAI:s VD för applikationer. “Det är bättre på att skapa kalkylblad, bygga presentationer, skriva kod, uppfatta bilder, förstå lång kontext, använda verktyg och sedan länka komplexa, flerstegsprojekt.”

Kodröd-memot

Altman skickade den interna memot den 1 december och mobiliserade resurser för att förbättra ChatGPT som svar på att Googles nyligen släppta Gemini 3 överträffade GPT-5.1 i benchmarktesterna. “Vi befinner oss i en kritisk tid för ChatGPT”, skrev Altman enligt rapporter.

Memot krävde en förändring av prioriteringarna, inklusive att skjuta upp planerade annonseringsfunktioner för att fokusera på produktkvalitet. Draget ekade Googles egen “code red” för tre år sedan när ChatGPT:s lansering hotade sökjättens dominans – en vändning som understryker hur snabbt konkurrenspositioner skiftar i AI.

COO Brad Lightcap, som talade vid en Fortune-evenemang tidigare denna månad, beskrev larmet som standardföretagspraxis snarare än panik. “Många företag genomför ibland [detta] för att skärpa fokus”, sa han och tonade ned den konkurrensrelaterade berättelsen medan han erkände brådskan bakom GPT-5.2:s utveckling.

Benchmarkprestation

OpenAI:s interna tester visar att GPT-5.2 återtar ledningen på resonemangsbenchmarkerna där Gemini 3 hade tagit ledningen. Modellen förbättrar kodgenerering, dokumentation, bildförståelse och flerstegsaktivitetsutförande – områden där företagskunder kräver konsekvent prestanda.

De förbättringar som kommer när ChatGPT närmar sig 800 miljoner veckovisa aktiva användare men står inför frågor om konverteringsfrekvenser från gratis till betalda nivåer. Bättre modellprestanda kan hjälpa till att motivera prenumerationskostnader när konkurrenter erbjuder alltmer kapabla alternativ till liknande prispunkter.

GPT-5.2:s förbättrade verktygsanvändningsförmåga stärker också ChatGPT Atlas, OpenAI:s webbläsare med agentläge som lanserades i oktober. De agenterrelaterade funktionerna som låter ChatGPT utföra flerstegsaktiviteter autonomt gynnas direkt av förbättrad resonemang och verktygskoordinering.

Front-end-programutveckling med GPT-5.2 (OpenAI)

Konkurrensdynamik

Den snabba reaktionen på Gemini 3 speglar en marknad där modellledarskap byter händer snabbt. Googles utgåva i november överraskade OpenAI efter månader då GPT-5 och GPT-5.1 höll benchmarkledningen. Anthropics Claude Opus 4.5, som släpptes senare samma månad, lade till en annan konkurrent.

OpenAI har samtidigt drivit företagsadoption, anställt Slack VD Denise Dresser som sin första chef för intäkter den här veckan. Företaget betjänar över en miljon företagskunder, inklusive Walmart (WMT ), Morgan Stanley (MS ) och Target – kontrakt som beror på att modellprestandan förblir konkurrenskraftig.

Kodröd-tillvägagångssättet tyder på att OpenAI ser modellkvalitet som existentiell snarare än inkrementell. Att skjupa upp av planerade annonseringsfunktioner för att påskynda modellutveckling signalerar förtroende för att kapacitet leder marknadsposition i AI – åtminstone för tillfället.

GPT-5.2 är tillgänglig omedelbart för ChatGPT Plus, Pro och Enterprise-prenumeranter. API-åtkomst följer standardrullningsförfaranden via OpenAI:s utvecklarplattform. Företaget har inte meddelat prisförändringar som åtföljer utgåvan.

Om GPT-5.2 behåller sin benchmarkledning kommer att bero på hur snabbt Google (GOOGL ) och Anthropic svarar. Den komprimerade utvecklingscykeln tyder på att eran med flermånaders modellledning kan vara på väg att ta slut, ersatt av kontinuerlig iteration där konkurrensfördel varar veckor snarare än kvartal.

Alex McFarland är en AI-journalist och författare som utforskar de senaste utvecklingarna inom artificiell intelligens. Han har samarbetat med många AI-startups och publikationer över hela världen.