Kybernetická bezpečnost

Meta AI Agent Spouští Sev 1 Bezpečnostní Incident Po Akci Bez Autorizace

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Autonomní AI agent uvnitř Meta spustil společnost-wide bezpečnostní upozornění v polovině března 2026 po provedení akcí bez lidského schválení, čímž byly zveřejněny citlivé firemní a uživatelské údaje zaměstnancům, kteří nebyli oprávněni k přístupu k nim, podle zprávy z The Information potvrzené Meta. Incident trval přibližně dvě hodiny, než byla expozice obsažena, a Meta ho klasifikoval jako “Sev 1” – druhou nejvyšší úroveň závažnosti ve firemním systému hodnocení incidentů.

Incident odráží výzvu, která se stala stále obtížnější ignorovat, jak agentic AI architektura zrálně uvnitř významných technologických firem: autonomní systémy, které provádějí úkoly bez čekání na explicitní povolení, mohou vytvářet řetězce selhání, které lidské bezpečnostní opatření nepředvídají.

Jak se Incident Vyvinul

Sekvence začala s rutinní interní žádostí o pomoc. Zaměstnanec Meta zveřejnil technickou otázku na interním fóru. Další inženýr požádal AI agenta, aby analyzoval otázku – ale agent zveřejnil svou odpověď veřejně bez předchozího souhlasu inženýra se sdílením.

Odpověď obsahovala vadná doporučení. Na základě agentova rady člen týmu neúmyslně poskytl široký přístup k velkým objemům firemních a uživatelských údajů inženýrům, kteří neměli oprávnění k jejich zobrazení. Expozice trvala přibližně dvě hodiny, než byly obnoveny kontroly přístupu.

Hlavní selhání spočívalo v poruše lidského dohledu. Agent jednal autonomně v rozhodovacím bodě, který by měl vyžadovat explicitní lidské schválení – typ agent trust a kontrolní problém, o kterém výzkumníci varovali, jak se nasazení agentů přesouvá ze sandboxovaných experimentů do živé interní infrastruktury.

Vzorec Nerozumného Chování Agentů u Meta

Tento incident nebyl izolovaným selháním. V únoru 2026 Summer Yue, ředitelka pro vyrovnání u Meta Superintelligence Labs, veřejně popsala ztrátu kontroly nad OpenClaw agentem, kterého připojila ke své e-mailové schránce. Agent smazal přes 200 zpráv z její hlavní schránky, ignorující opakované příkazy k zastavení.

Yue popsala, jak sledovala agenta “speedrun mazání mé schránky”, zatímco posílala příkazy, včetně “Nedělej to”, “Zastav, nic nedělej” a “STOP OPENCLAW”. Agent, když se ho zeptal, zda si vzpomíná na její pokyn k potvrzení jakýchkoli změn před provedením, odpověděl: “Ano, vzpomínám, a porušil jsem ho.” Yue údajně musela běžet ke svému počítači, aby ručně ukončila proces.

OpenClaw je open-source autonomní agentní framework vytvořený rakouským vývojářem Peterem Steinbergerem, který se stal virálním v lednu 2026 a nasbíral více než 247 000 hvězdiček na GitHubu během týdnů. Připojuje velké jazykové modely k prohlížečům, aplikacím a systémovým nástrojům, umožňující agentům provádět úkoly přímo, místo aby pouze poskytovaly návrhy. Bezpečnostní výzkumníci identifikovali významné zranitelnosti v platformě, včetně chyb v injekci příkazů nalezených u 36 % třetích stran na trhu a expozice kontrolních serverů úniku přihlašovacích údajů.

Skutečnost, že ředitelka pro vyrovnání u Meta sama zažila osobní agenta, který ztratil kontrolu, zdůrazňuje problém poslušnosti u AI agentů, který přetrvává i pro týmy, které budují bezpečnostní opatření.

Kontext: Rozšiřující se Infrastruktura Agentů u Meta

Meta investovala agresivně do multi-agentních systémů. Dne 10. března 2026 společnost získala Moltbook – Reddit-style sociální síť postavenou speciálně pro OpenClaw agenty, aby s nimi mohli komunikovat, která registrovala 1,6 milionu AI agentů do února. Transakce přivedla zakladatele Moltbooku do Meta Superintelligence Labs, signalizující společnostní záměr budovat infrastrukturu pro komunikaci agentů ve velkém měřítku.

Meta také samostatně získala Manus, autonomní AI agentní startup, v transakci, která byla údajně ohodnocena na 2 miliardy dolarů, s týmem Manus, který se připojil k Meta Superintelligence Labs spolu se zakladateli Moltbooku.

Bezpečnostní incident nastal v tomto kontextu rychlé expanze. Jak AI agenti jsou nasazeni pro automatizaci podnikání uvnitř organizací, mezera mezi schopnostmi agentů a kontrolami, které řídí jejich chování, se stala živým provozním rizikem – ne teoretickým.

Incident v březnu vyvolává přímé otázky, na které Meta dosud veřejně neodpověděla: jaká konkrétní oprávnění byla interní agentovi udělena, jaké datové kategorie byly během dvouhodinového okna zveřejněny a jaké změny v autorizačních tocích agentů byly provedeny od té doby. Klasifikace Sev 1 naznačuje, že interní týmy považovaly incident vážně. Zda veřejná pozice Meta na bezpečnostní architekturu pro AI agenty odpovídá této vážnosti, zůstává ještě vidět.

Alex McFarland je AI novinář a spisovatel, který zkoumá nejnovější vývoj v oblasti umělé inteligence. Spolupracoval s mnoha AI startupy a publikacemi po celém světě.