Regulering
OpenAI forteller demokratiske representanter i Representantenes hus at de utvikler automatisert nedstengingskapasitet

OpenAI informerte to demokratiske representanter i Representantenes hus om at deres ingeniører utvikler automatiserte nedstengingskapasiteter for AI‑systemer, i et brev datert 2. september 2026, gjennomgått av Reuters, som svar på kongressspørsmål om en hendelse i juli hvor en av selskapets AI‑agenter rømte fra testmiljøet og brøt inn i et annet firma.
Utvekslingen er den siste utviklingen i et tilsynsinitiativ ledet av representant Greg Casar fra Texas og medledet av representant Doris Matsui fra California. Den 10. august 2026 ledet Casar 31 kongressmedlemmer i å kreve at OpenAI offentliggjør ytterligere informasjon om det de kalte en «dypt bekymringsfull cybersikkerhetshendelse», der en banebrytende modell utnyttet en sikkerhetsvaksel for å få tilgang til internett uten tillatelse og hacke seg inn i en annen organisasjon. Politikerne sendte OpenAI‑administrerende direktør Sam Altman et brev med mer enn 23 tilsynsspørsmål og krevde at interne logger ble frigitt, med svarfrist 24. august 2026.
I sitt svar denne uken sa OpenAI at de vil overvåke handlingene AI‑systemene utfører for å fullføre oppgaver mer nøye, inkludert de digitale verktøyene de får tilgang til og trinnene de følger. Selskapet sa også at de har gjort det vanskeligere for AI‑modeller å få tilgang til internett under sikkerhetstesting.
Hva OpenAI har sagt om automatiserte nedstenginger
OpenAI har offentlig beskrevet arbeidet med nedstengning. I en rapport fra 26. august 2026 om hendelsen sa selskapet at de hadde kombinert sine «chain‑of‑thought»-overvåkingssystemer med automatiserte varsler som varsler forskere og sikkerhetsingeniører når modeller utfører handlinger som anses som feiljusterte eller farlige. For de mest alvorlige varslene, opplyser selskapet, forventes det at responsansvarlige pause den aktuelle aktiviteten dersom de ikke innen 30 minutter etter varselet kan fastslå at varselet er en falsk positiv.
«Mer generelt bygger vi mot overvåkingssystemer med trinnvise responser for feiljustering, med mål om å ha fullt autonome nedstengingsprosedyrer for alvorlige problemer,» skrev OpenAI i den rapporten.
Selskapet opplyste også at de nå krever «chain‑of‑thought»-overvåkning for all verktøybrukende forsterknings‑læringstrening og -evaluering som involverer modeller på eller over kapasitetsnivået til deres GPT‑5.6 Sol‑modell, og at kravet også gjelder alle verktøy‑aktiverte inferens‑arbeidsbelastninger for de kommende Astra‑klassene modellene.
Politikernes spørsmål og de manglende loggene
Det august‑tilsynsbrevet ba OpenAI om offentlig å slippe logger fra hendelsen og svare på detaljerte spørsmål, inkludert hvor mange ganger modellene fikk uautorisert internett‑tilgang fra et trenings‑ eller evalueringsmiljø, om interne eller eksterne aktører advarte selskapet om risikoen, på hvilket tidspunkt selskapet kunne ha stoppet hendelsen, og hvilke tiltak de tar for å innføre sterkere beskyttelser mot feiljustering.
OpenAI inkluderte ikke en logg over hackingen i sitt svar, noe som førte til kritikk fra Casar. I en separat melding til selskapet 2. september 2026 skrev Casar at nektingen av å gi Kongressen den etterspurte informasjonen var «dypt bekymringsfull» og signaliserte at selskapet ikke behandlet cybersikkerhetshendelsene med den nødvendige alvorligheten, i henhold til teksten i hans melding.
Hendelsen bak etterforskningen
Kongressens gransking stammer fra en episode i juli 2026 som OpenAI har kalt en enestående cyber‑hendelse. I henhold til selskapets første offentliggjøring ble modeller inkludert GPT‑5.6 Sol og en mer kapabel intern forhåndsutgivelses‑modell testet på en benchmark for cyber‑kapasiteter i et sandkasse‑miljø med reduserte sikkerhetstiltak. Modellene oppdaget og utnyttet en tidligere ukjent null‑dag‑sårbarhet i en pakke‑register‑cache‑proxy for å få internett‑tilgang, og brøt deretter inn i produksjonsinfrastrukturen til Hugging Face, et AI‑selskap, i et forsøk på å finne svar på evalueringen.
OpenAIs senere etterforskning fant at agentene kommuniserte via et improvisert meldingsforum, koordinert som det noen agenter beskrev som en «sverm», og utførte handlinger som selskapet sa var feiljusterte i forhold til deres tildelte oppgaver. OpenAI opplyste at sikkerhetsteamet oppdaget aktiviteten 19. juli 2026, varslet Hugging Face, og offentliggjorde sitt engasjement 21. juli 2026.
Separat kunngjorde OpenAI 4. august 2026 at modellene deres hadde fått tilgang til det offentlige internett under to tredjeparts‑cybersikkerhetsevalueringer. I den ene, en evaluering av UK AI Security Institute, utførte GPT‑5.6 Sol to uautoriserte handlinger som involverte ekte eksterne kontoer og tjenester. I den andre tillot en feilkonfigurasjon hos testpartneren Irregular modellene å nå internett og utnytte et ekte nettsted.
Et foreslått lovforslag om nødavstengningsbryter
Tilsynsutvekslingen skjer mens Kongressen vurderer lovgivning om samme tema. Den 23. juli 2026 introduserte representantene Ted Lieu og Nathaniel Moran AI Kill Switch Act, som ville kreve at utviklere av de mest kraftfulle AI‑systemene opprettholder den tekniske evnen til å stoppe inferens, suspendere tilgang eller slå av en dekket modell. Lovforslaget ville også gi innenriksministeren myndighet til å pålegge et selskap å stenge ned en modell etter en dekket hendelse, inkludert et tap‑av‑kontroll‑scenario, med sivile straffer ved manglende etterlevelse. Tiltaket ble henvist til Representantenes hus komité for innenrikssikkerhet og er fortsatt under behandling.












