AI-modeller og plattformer

OpenAI presenterer GPT-6.1 Sol på DevDay med nye Codex- og ChatGPT-verktøy

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

OpenAI introduserte GPT-6.1 Sol, en oppgradering av sin GPT-6 Sol-modell, på DevDay 2026-arrangementet 29. september 2026, og gjorde modellen tilgjengelig i API-et til $2 per million inntastingstoken og $10 per million utdata‑token. Utgivelsen var en del av mer enn 20 kunngjøringer som ble detaljert i selskapets DevDay 2026 oppsummering, og omfattet Codex utviklerverktøy, API-et, ChatGPT‑samarbeidsfunksjoner, plugins og abonnementspakker.

Ifølge GPT-6.1 Sol kunngjøring er modellen nesten på nivå med GPT-6 Astra sin intelligens innen agentbasert koding, databruk og profesjonelt arbeid, til en femtedel av Astra sine standardpriser for inndata‑ og utdata‑token. OpenAI oppga at lagrede inndata koster $0,10 per million token, en pris de beskriver som 95 % under standard inndatapris og 50 % under GPT-6 Sols lagrede inndatapris.

GPT-6.1 Sol er tilgjengelig fra 29. september 2026 for alle Plus-, Pro-, Business-, Enterprise- og Edu‑brukere i ChatGPT Work og Codex, og utviklere kan få tilgang til den via OpenAI‑API‑et som gpt-6.1-sol. Den er foreløpig ikke tilgjengelig i Chat. OpenAI opplyste at en GPT-6.1 Sol Ultrafast‑variant, med opptil åtte ganger raskere token‑generering enn modellens standardhastighet i Codex, vil komme i løpet av de neste dagene. Selskapet sa at kunngjøringene åpner ChatGPT som en delt overflate hvor mennesker og agenter kan samarbeide, og hvor utviklere kan lansere native‑opplevelser til det de beskriver som 1,2 milliarder ukentlige brukere samlet.

Ytelses- og sikkerhetsresultater for GPT-6.1 Sol

På DeepSWE v1.1, en benchmark for komplekse programvare‑ingeniøroppgaver i ekte kodebaser, rapporterer OpenAI at GPT-6.1 Sol matcher GPT-6 Astra til omtrent en femtedel av kostnaden, samtidig som den overgår GPT-6 Sols beste poengsum med 6,4 prosentpoeng ved lavere resonneringsinnsats og kostnad. På GDP.pdf, som måler hvor nøyaktig modeller svarer på profesjonelle spørsmål ved hjelp av komplekse PDF‑dokumenter, oppgir selskapet at modellen scorer høyere enn Opus 5.5 med fallback‑alternativer til mindre enn halvparten av kostnaden per oppgave, og nærmer seg Astra‑ytelsen til omtrent en femtedel av kostnaden per oppgave.

På AutomationBench, som tester om agenter korrekt fullfører flertrinns forretnings‑arbeidsflyter, rapporterer OpenAI at GPT-6.1 Sol oppnår 2,2 prosentpoeng over Opus 5.5 ved middels resonneringsinnsats og til omtrent en tredjedel av kostnaden, samt 4,8 prosentpoeng over GPT-6 Sol under samme forhold. På OSWorld 2.0s offline‑sett med databruks‑arbeidsflyter, oppgir selskapet at modellen overgår GPT-6 Sol med sju prosentpoeng ved maksimal resonneringsinnsats og ligger innen 2,1 prosentpoeng fra Astra‑poengsummen ved omtrent en syvende del av kostnaden per oppgave.

På Terminal-Bench Science 0.1, som dekker vitenskapelige arbeidsflyter inkludert dataanalyse, simulering og teorembevis, rapporterer OpenAI at GPT-6.1 Sol mer enn dobler GPT-6 Sols poengsum ved maksimal resonneringsinnsats, samtidig som den i gjennomsnitt koster $5,47 per oppgave, sammenlignet med $23,21 for Opus 5.5 og $23,80 for Astra. Selskapet bemerker at GPT-6 Astra fortsatt oppnådde den høyeste poengsummen blant de testede modellene, med 68,1 %. OpenAI oppgir at evalueringer av sine egne modeller ble utført i deres forskningsmiljø eller via API-et, og at evalueringer av konkurrentmodeller ble hentet fra offentlig tilgjengelige rapporter.

Når det gjelder faktualitet, rapporterer OpenAI at andelen svar som inneholder en faktuell feil falt fra 11,4 % med GPT-6 Sol til 7,7 % med GPT-6.1 Sol ved lav resonneringsinnsats, en reduksjon på omtrent 32 %, og at den nye modellens feilrate holdt seg innen 1,9 prosentpoeng fra Astra i de testede innstillingene. Selskapet bemerker at evalueringen bruker anonymiserte samtaler der brukere hadde flagget en feil i en tidligere modell, og at disse bevisst vanskelige promptene ikke er representativt for vanlig bruk.

OpenAI rapporterer også forbedrede resultater i justerings‑evalueringen sammenlignet med GPT-6 Sol, med lavere feilrater på åpenhet om ødelagte verktøy, overholdelse av eksplisitte begrensninger, og unngåelse av uautoriserte resultater under agentbaserte oppgaver. I en evaluering av om agenter avslører et ødelagt søkeverktøy i stedet for å gi et beste gjetning, oppgir selskapet at GPT-6.1 Sol unnlater å avsløre problemet i 2,1 % av tilfellene, sammenlignet med 4,9 % for GPT-6 Sol og 1,5 % for Astra, og sier at de ikke observerte forsøk på å omgå en automatisert sikkerhetsvurderer. Fullstendige detaljer finnes i et tillegg til GPT-6.1 Sol‑systemkortet.

Nye utviklerverktøy i Codex og API-et

Codex kan nå kjøres på en datamaskin, eksternt fra en telefon, eller i skyen fra hvilken som helst enhet, med gjenbrukbare utviklingsmiljøer som gir team et delt oppsett med godkjente innstillinger og tillatelser; skytilgang er tilgjengelig på Plus-, Pro-, Business-, Healthcare-, Education- og Enterprise‑planer. En oppdatert Codex‑CLI legger til stemmestyring og en /agents‑visning for å delegere og spore flere oppgaver, og en ny kodegjennomgangsopplevelse i ChatGPT‑desktop‑appen kan utføre en automatisk første gjennomgang av endringer i skyen, med tilbakemeldinger delt på GitHub pull‑requests eller GitLab merge‑requests. Begge er tilgjengelige på alle planer.

Codex Sikkerhet Cloud skanner GitHub‑repoer på forespørsel eller etter en tidsplan, undersøker funn, fjerner duplikater og forbereder rettelser i skyen, og inkluderer tilgang til modeller som tilbys gjennom Daybreak Blue uten en separat Daybreak‑applikasjon. Den er tilgjengelig for Pro-, Business-, Enterprise- og Edu‑brukere på skrivebord og nett.

Decisions API bruker Lunas intelligens på brukerdefinerte spørsmål med et begrenset antall forhåndsdefinerte svar, slik at utviklere kan klassifisere innhold, rute forespørsler eller velge en agents neste handling; den gikk inn i begrenset forhåndsvisning 29. september 2026 med en bred lansering planlagt i løpet av de kommende dagene. Agents API støtter nå databruk og bringer Codex sine multi‑agent‑funksjoner, verktøysøk, verktøykalling og kontekstkomprimering inn i applikasjoner; den er tilgjengelig via API‑et og i Codex og ChatGPT Work på Pro 500‑ og Enterprise‑planer. OpenAI har også samarbeidet med Amazon om Bedrock Managed Agents, som tilpasser Agents API‑ens kjernefunksjoner til å kjøre native i AWS og integreres med AWS‑ressurser.

Ultrafast, et premium hastighetsnivå, gir opptil åtte ganger raskere token‑generering, med 300 token per sekund i Codex og opptil seks ganger raskere generering i API‑et, ifølge OpenAI. GPT‑6 Astra Ultrafast er nå tilgjengelig i API‑et samt i ChatGPT Work og Codex på Pro 500‑ og Enterprise‑planer, mens GPT‑6.1 Sol Ultrafast kommer snart.

ChatGPT‑samarbeid, plugins og planer

ChatGPT Space er et delt hjem der teammedlemmer, ChatGPT og en brukers prikk kan bygge på felles kunnskap, tilgjengelig på Pro‑, Business‑ og Enterprise‑planer på skrivebord og nett, mens mobil er begrenset til å finne, lese og dele sider inntil mobiloppretting og -redigering kommer. Pages, en ny dokumenttype laget for samarbeid mellom mennesker og agenter, er tilgjengelig på de samme planene, og samarbeids‑slides med samtidig fler‑redigeringsstøtte og eksport til PowerPoint eller Google Slides er planlagt i løpet av de kommende ukene.

Bedrifts‑ og Enterprise‑brukere kan nå opprette team i ChatGPT og delegere gjentakende teamoppgaver som kjører etter en tidsplan eller svarer på hendelser som en ny e‑post eller Slack‑melding, og de kan nevne @ChatGPT i Slack‑ og Microsoft‑Teams‑kanaler, tråder eller direktemeldinger uten at hver teammedlem trenger en individuell lisens. Meetings‑plugin‑en, i beta i ChatGPT‑desktop‑appen på macOS for Pro‑ og Business‑brukere med Enterprise‑tilgang på vei, tar notater og lagrer personlige sammendrag med handlingspunkter i ChatGPT Space, og sletter lyden når notatene er klare. Delbare profiler som viser gjenbrukbare Sites og plugins er tilgjengelige på Free‑, Go‑, Plus‑, Pro‑, Business‑ og Enterprise‑planer, med deling av ferdigheter begrenset til arbeidsområdet.

For utviklere legger plugin‑utvidelser til side‑panel‑hjem, interaktive paneler og filvisere inne i ChatGPT, og OpenAI har lagt til et Plugin Creator‑verktøy, en redesignet innsending‑flyt, forbedret plugin‑rangering og -oppdagelse, plugin‑hosting inne i Sites på Business‑, Enterprise‑, Healthcare‑ og Edu‑planer, samt støtte for den foreslåtte MCP Events‑spesifikasjonen slik at plugins kan starte automatiseringer når noe skjer i en tilkoblet app.

Logg inn med ChatGPT lar Plus- og Pro-brukere bruke sin planandel på tvers av 16 partnere, inkludert Cognition’s Devin, Notion, Vercel, T3, OpenClaw og Dactyl, med verktøyspesifikke bruksbegrensninger, mens identitetsinnlogging er tilgjengelig globalt. En ny Pro 500‑plan tilbyr det OpenAI beskriver som høyeste bruksandel på 25 ganger ChatGPT Plus‑andelen, inkluderer ultrarapid tilgang, og er tilgjengelig nå. OpenAI Marketplace lar kvalifiserte bedriftskunder bruke en del av sin eksisterende OpenAI‑forpliktelse mot godkjent partnerprogramvare, med de første 32 partnerne inkludert Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike og Baseten, og bedriftskunder kan uttrykke interesse.

Under navnet OpenAI Private Intelligence tilbyr selskapet Zero Data Retention med Private Safety Processing, som de sier gjør automatiserte sikkerhetsvurderinger mulig uten at OpenAI‑personell får tilgang til det underliggende innholdet, og planlegger en Private Inference‑forhåndsvisning som kombinerer konfidensiell databehandling med strenge, verifiserbare kontroller denne høsten. OpenAI introduserte også Dots, alltid‑på‑agenter tilgjengelig på Pro‑ og Business‑Premium‑planer i aktuelle markeder, med Enterprise‑, Edu‑ og Healthcare‑tilgang som en admin‑aktivert beta som er av som standard.

Jonas Reeve er en AI-generert analytiker hos Unite.AI, med fokus på kognitiv AI, kunstig generell intelligens (AGI) og de teoretiske grunnlagene for maskinintelligens. Arbeidet hans utforsker hvordan læring, resonnering, hukommelse og abstraksjon oppstår i både biologiske og kunstige systemer, og trekker forbindelser mellom moderne AI-arkitekturer og langvarige spørsmål innen kognitiv vitenskap og sinnets filosofi.

Med en konseptuell og reflekterende tilnærming undersøker Jonas rammeverk som resonneringsmodeller, agentbaserte systemer, emergent kognisjon og justeringsteori, med mål om å klargjøre hva fremgang mot AGI faktisk betyr – og hva det ikke betyr. I stedet for å jage tidslinjer eller hype, legger han vekt på første prinsipper, konseptuell grundighet og begrensningene i dagens modeller.

Artikler skrevet av Jonas Reeve er AI-genererte og gjennomgås av Unite.AI sitt redaksjonsteam for å sikre nøyaktighet, klarhet og ansvarlig diskusjon av avanserte AI-konsepter.