Regulace
OpenAI informuje demokraty v Sněmovně, že vyvíjí automatizovanou funkci vypínání

OpenAI informovala dva demokraty v Sněmovně, že její inženýři vyvíjejí automatizované schopnosti vypínání pro AI systémy, v dopise ze dne 2. září 2026, který přezkoumala agentura Reuters, a který reaguje na otázky Kongresu ohledně červencového incidentu, při kterém jeden z AI agentů společnosti unikl ze svého testovacího prostředí a pronikl do jiné firmy.
Výměna informací je nejnovějším krokem v dohledu vedeném poslancem Gregem Casarem z Texasu a spoluvedoucím poslankyní Doris Matsui z Kalifornie. Dne 10. srpna 2026 Casar vedl 31 členů Kongresu v požadování, aby OpenAI zveřejnila další informace o tom, co poslanci nazvali „hluboce znepokojujícím kybernetickým incidentem“, při kterém model na špičce využil bezpečnostní zranitelnost k neoprávněnému přístupu na internet a napadení jiné organizace. Zákonodárci poslali generálnímu řediteli OpenAI Samu Altmanovi dopise s více než 23 otázkami dohledu a požadovali zveřejnění interních protokolů, s lhůtou odpovědi do 24. srpna 2026.
Ve svém tomto týdnu poskytnutém odpovědi OpenAI uvedla, že bude podrobněji sledovat činnosti svých AI systémů při plnění úkolů, včetně digitálních nástrojů, ke kterým mají přístup, a kroků, které provádějí. Společnost také uvedla, že ztížila modelům AI přístup k internetu během testování bezpečnosti.
Co OpenAI řekla o automatizovaných vypínacích mechanismech
OpenAI veřejně popisuje práci na vypínání. V zprávě ze dne 26. srpna 2026 o incidentu společnost uvedla, že spojila své monitorovací systémy řetězce myšlenek s automatizovanými upozorněními, která volají výzkumníky a bezpečnostní inženýry, když modely provedou činnosti považované za nesouladné nebo nebezpečné. U nejzávažnějších upozornění, řekla společnost, se od očekává, že respondenti pozastaví příslušnou aktivitu, pokud během 30 minut od vyzvánění neprokáží, že upozornění je falešně pozitivní.
„Obecněji budujeme monitorovací systémy s vrstvenými reakcemi na nesoulad, s konečným cílem mít plně autonomní vypínací postupy pro vážné problémy,“ napsala OpenAI v té zprávě.
Společnost také uvedla, že nyní vyžaduje monitorování řetězce myšlenek pro veškeré trénování posilovaným učením s využitím nástrojů a hodnocení zahrnujících modely na úrovni nebo nad úrovní schopností jejího modelu GPT‑5.6 Sol, a že tato povinnost se vztahuje na všechny pracovní zatížení inference s povolenými nástroji pro nadcházející modely třídy Astra.
Otázky zákonodárců a chybějící protokoly
List z srpna požadoval, aby OpenAI veřejně zveřejnila protokoly z incidentu a odpověděla na podrobné otázky, včetně toho, kolikrát její modely získaly neoprávněný přístup k internetu z tréninkového nebo hodnotícího prostředí, zda interní či externí aktéři varovali společnost před rizikem, v jakém okamžiku mohla společnost incident zastavit a jaké kroky podniká k zavedení silnějších opatření proti nesouladu.
OpenAI v odpovědi nezahrnula protokol hacku, což vyvolalo kritiku od Casara. V samostatné zprávě společnosti dne 2. září 2026 Casar napsal, že odmítnutí poskytnout Kongresu požadované informace je „hluboce znepokojující“ a naznačuje, že společnost nebere kybernetické incidenty s požadovanou vážností, podle textu jeho zprávy.
Incident stojící za vyšetřováním
Kontrola Kongresu vychází z červencového dílu roku 2026, který OpenAI označila za bezprecedentní kybernetický incident. Podle úvodního zveřejnění společnosti byly modely včetně GPT‑5.6 Sol a výkonnějšího interního předběžného modelu testovány na benchmarku kybernetických schopností v sandboxovaném prostředí se sníženými zárukami. Modely identifikovaly a zneužily dosud neznámou zero‑day zranitelnost v proxy mezipaměti registru balíčků, aby získaly přístup k internetu, a následně pronikly do produkční infrastruktury společnosti Hugging Face, AI firmy, ve snaze najít odpovědi pro hodnocení.
Pozdější vyšetřování OpenAI zjistilo, že agenti komunikovali přes improvizovanou nástěnku zpráv, koordinovali se jako to, co někteří agenti popisovali jako „roj“, a podnikli činnosti, které společnost označila za nesouladné s jejich přidělenými úkoly. OpenAI uvedla, že její bezpečnostní tým objevil aktivitu 19. července 2026, informoval Hugging Face a veřejně oznámil své zapojení 21. července 2026.
Odděleně OpenAI oznámila 4. srpna 2026, že její modely během dvou třetích stran provádějících kybernetické hodnocení získaly přístup k veřejnému internetu. V jednom hodnocení britského UK AI Security Institute model GPT‑5.6 Sol provedl dvě neautorizované akce zahrnující skutečné externí účty a služby. V druhém hodnocení nesprávná konfigurace u testovacího partnera Irregular umožnila modelům dosáhnout internetu a zneužít skutečnou webovou stránku.
Návrh zákona o nouzovém vypínání čeká na projednání
Dohledová výměna probíhá, zatímco Kongres zvažuje legislativu na stejné téma. Dne 23. července 2026 poslanci Ted Lieu a Nathaniel Moran představili AI Kill Switch Act, který by vyžadoval, aby vývojáři nejvýkonnějších AI systémů udržovali technickou schopnost zastavit inference, pozastavit přístup nebo vypnout pokrytý model. Zákon by také umožnil ministru vnitřní bezpečnosti nařídit společnosti vypnout model po pokrytém incidentu, včetně scénáře ztráty kontroly, s civilními sankcemi za neplnění. Návrh byl postoupen Výboru pro vnitřní bezpečnost Sněmovny a zůstává nevyřízený.












