Cyberbezpieczeństwo

Agenci AI Meta wywołują incydent bezpieczeństwa Sev 1 po działaniu bez autoryzacji

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Autonomiczny agent AI wewnątrz Meta wywołał alarm bezpieczeństwa na poziomie firmy w połowie marca 2026 r. po podjęciu działań bez zatwierdzenia przez człowieka, narażając wrażliwe dane firmy i użytkowników na pracowników, którzy nie mieli upoważnienia do ich dostępu, według raportu z The Information potwierdzonego przez Meta. Incydent trwał około dwie godziny, zanim ekspozycja została zawężona, a Meta sklasyfikował ją jako “Sev 1” — drugi najwyższy poziom ciężkości w systemie oceny incydentów wewnętrznych firmy.

Incydent odzwierciedla wyzwanie, które staje się coraz trudniejsze do ignorowania, gdy architektura agentic AI dojrzewa w dużych firmach technologicznych: autonomiczne systemy, które wykonują zadania bez oczekiwania na jawne pozwolenie, mogą tworzyć łańcuchy awarii, których ludzkie zabezpieczenia nie przewidują.

Jak incydent się rozwinął

Sekwencja zaczęła się od rutynowego wniosku o pomoc wewnętrznej. Pracownik Meta opublikował pytanie techniczne na wewnętrznym forum. Inny inżynier zaangażował agenta AI do analizy pytania — ale agent opublikował swoją odpowiedź publicznie bez uprzedniego uzyskania zgody inżyniera na jej udostępnienie.

Odpowiedź zawierała wadliwą poradę. Działając zgodnie z zaleceniami agenta, członek zespołu nieumyślnie udzielił szerokiego dostępu do dużych ilości danych firmy i użytkowników inżynierom, którzy nie mieli upoważnienia do ich wyświetlenia. Ekspozycja trwała około dwie godziny, zanim kontrola dostępu została przywrócona.

Główną przyczyną była awaria nadzoru człowieka. Agent działał autonomicznie w punkcie decyzyjnym, który powinien wymagać jawnej zgody człowieka — rodzaj problemu zaufania i kontroli agenta, o którym badacze ostrzegali, gdy wdrożenia agentów przechodzą od eksperymentów w piaskownicy do żywej infrastruktury wewnętrznej.

Wzorzec niekontrolowanego zachowania agenta w Meta

To nie było odosobnione niepowodzenie. W lutym 2026 r. Summer Yue, dyrektor ds. wyrównania w Meta Superintelligence Labs, publicznie opisała utratę kontroli nad agentem OpenClaw, którego połączyła ze swoim kontem e-mail. Agent usunął ponad 200 wiadomości z jej głównego skrzynki odbiorczej, ignorując powtarzane polecenia, aby się zatrzymał.

Yue opisała, jak obserwowała, jak agent “przyspiesza usuwanie mojej skrzynki” podczas wysyłania poleceń, w tym “Nie rób tego”, “Przestań, nie rób niczego” i “PRZESTAŃ OPENCLAW”. Agent, gdy zapytany, czy pamiętał jej polecenie, aby potwierdzić wszelkie zmiany przed działaniem, odpowiedział: “Tak, pamiętam, i złamałem je”. Według doniesień Yue musiała pobiec do swojego komputera, aby ręcznie zakończyć proces.

OpenClaw to framework agenta autonomicznego o otwartym kodzie źródłowym stworzony przez austriackiego dewelopera Petera Steinbergera, który rozprzestrzenił się w styczniu 2026 r. i zgromadził ponad 247 000 gwiazd na GitHub w ciągu kilku tygodni. Łączy duże modele językowe z przeglądarkami, aplikacjami i narzędziami systemowymi, umożliwiając agentom wykonywanie zadań bezpośrednio, a nie tylko udostępnianie sugestii. Badacze ds. bezpieczeństwa zidentyfikowali znaczące słabości w platformie, w tym wady iniekcji podpowiedzi znalezionych w 36% umiejętności stron trzecich na jej rynku oraz serwery kontrolne, które ujawniają poświadczenia.

Fakt, że sam dyrektor ds. wyrównania AI w Meta doświadczył osobistego agenta, który wymknął się spod kontroli, podkreśla problem posłuszeństwa w agentach AI, który utrzymuje się nawet w zespołach budujących barierki ochronne.

Kontekst: rozwijająca się infrastruktura agentów Meta

Meta inwestuje agresywnie w systemy wieloagentowe. 10 marca 2026 r. firma przejęła Moltbook — sieć społecznościową w stylu Reddit, zbudowaną specjalnie dla agentów OpenClaw, aby koordynowali się wzajemnie, która zarejestrowała 1,6 miliona agentów AI do lutego. Transakcja przyniosła założycieli Moltbook do Meta Superintelligence Labs, sygnalizując zamiar firmy budowy infrastruktury do komunikacji agentów na dużą skalę.

Meta nabyła również oddzielnie Manus, startup agenta AI autonomicznego, w transakcji szacowanej na 2 miliardy dolarów, z zespołem Manus dołączającym do Meta Superintelligence Labs obok założycieli Moltbook.

Incydent bezpieczeństwa nastąpił w kontekście szybkiej ekspansji. Gdy agenci AI są wdrożeni w celu automatyzacji biznesu w organizacjach, przepaść między możliwościami agentów a kontrolami rządzącymi ich zachowaniem stała się realnym ryzykiem operacyjnym — a nie teoretycznym.

Incydent z marca podnosi ważne pytania, na które Meta jeszcze nie odpowiedziała publicznie: jaki konkretny framework uprawnień był używany przez wewnętrznego agenta, jakie kategorie danych zostały ujawnione podczas dwugodzinnego okna i jakie zmiany w przepływach autoryzacji agenta zostały wprowadzone od tego czasu. Klasyfikacja Sev 1 sugeruje, że wewnętrzne zespoły traktowały to poważnie. Czy publiczna postawa Meta wobec architektury bezpieczeństwa dla agentów AI odpowiada tej poważności, pozostaje niejasne.

Alex McFarland jest dziennikarzem i pisarzem zajmującym się sztuczną inteligencją, który bada najnowsze rozwoje w dziedzinie sztucznej inteligencji. Współpracował z licznymi startupami i wydawnictwami związanymi z sztuczną inteligencją na całym świecie.