Kybernetická bezpečnost

Anthropic rozšiřuje Cyber Verification Program na tři úrovně přístupu

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Anthropic dne 6. října 2026 oznámil rozšířený Cyber Verification Program, který zpřístupňuje pokročilé kybernetické schopnosti a klasifikátory s omezeným blokováním kvalifikovaným bezpečnostním odborníkům ve třech úrovních přístupu. Každá úroveň zahrnuje přístup k modelům Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 a budoucím novým modelům.

Anthropic popsal kybernetickou bezpečnost jako inherentně dvojí využití a uvedl, že stejné schopnosti, které umožňují bezpečnostnímu týmu najít a opravit zranitelnost, mohou také pomoci škodlivému aktérovi ji zneužít. Společnost uvedla, že její obecně dostupné modely, včetně Claude Opus 5.5, Claude Fable 5.1 a Claude Sonnet 5.5, obsahují konzervativní kybernetické ochrany, které blokují většinu kybernetické práce, což je podle ní zamýšleno k omezení škodlivých aktivit ze strany útočníků, zatímco se snaží snížit počet falešně pozitivních výsledků při zabezpečeném programování.

Během šesti měsíců před oznámením poskytoval Anthropic důvěryhodný přístup prostřednictvím dvou programů: Project Glasswing, který organizacím zabezpečujícím kritický software umožnil přístup k modelu Claude Mythos, a původní Cyber Verification Program, který ověřeným bezpečnostním týmům poskytl snížené ochrany u modelů Claude Opus a Claude Sonnet. Tyto dva programy jsou nyní sloučeny do jedné rozšířené nabídky. Anthropic uvedl, že jeho obecně dostupné modely jsou nadále použitelné všemi uživateli pro úkoly jako revize kódu, oprava známých problémů, vyhledávání zranitelností ve vlastním zdrojovém kódu a třídění bezpečnostních upozornění.

Obrana, Red Team a Specialized Access

Přístup Defense Access zahrnuje obrannou práci, včetně úkolů bezpečnostního operačního centra a reakce na incidenty, reverzního inženýrství malwaru a analýzy a validace zranitelností. Příklady oprávněných organizací zahrnují bezpečnostní týmy ve firmách, neziskových organizacích, univerzitách a vládních institucích, které chrání systémy, jež vlastní nebo spravují; provozovatele kritické infrastruktury jakékoli velikosti, jako jsou regionální nemocnice nebo městské utility; menší bezpečnostní firmy; správce open-source projektů; a jednotlivé výzkumníky s historií nahlášených zranitelností. Anthropic uvedl, že očekává, že mnoho organizací provádějících obrannou práci v oblasti kybernetické bezpečnosti bude pro tuto úroveň způsobilé, a že si klade za cíl reagovat na žádosti během několika dnů.

Red Team Access přidává autorizované penetrační testování a red‑teamování proti systémům, které organizace smí testovat, včetně IT systémů v kritických odvětvích. Příklady oprávněných organizací zahrnují interní red týmy, vládní red týmy a firmy zabývající se bezpečnostním a penetračním testováním. Uživatelé v této úrovni stále čelí blokacím v reálném čase u akcí, které by mohly způsobit fyzické poškození nebo masovou narušení, jako je nasazení ransomware, poškození fyzických systémů nebo penetrační testování vysoce rizikových bezpečnostních systémů. Anthropic uvedl, že očekává, že žádosti v této úrovni budou zpracovány během několika týdnů, zapisuje oprávněné organizace do Defense Access, zatímco jsou jejich žádosti o Red Team Access přezkoumávány, a omezuje tuto úroveň na organizace.

Specialized Access poskytuje nejméně kybernetických blokací a je vyhrazen pro omezenou sadu ověřených organizací, které jsou oprávněny testovat bezpečnostní systémy, jež mohou ovlivnit lidské životy nebo narušit trhy, jako jsou systémy pro řízení letů, elektrické sítě, telekomunikační sítě, infrastruktura mezibankovních převodů a vládní administrativní sítě. Anthropic v současnosti provádí podrobnou kontrolu každé organizace v této úrovni ve spolupráci s vládou USA a stávající členové Project Glasswing přecházejí do této úrovně bez nutnosti opětovného schválení pro aktuální modely.

Podle stránky Claude Help Center může jednotlivec žádat pouze o Defense Access a musí mít placený plán, zatímco Red Team Access a Specialized Access jsou otevřeny pouze organizacím. Každá organizace podá jedinou žádost a Anthropic umístí žadatele do nejvyšší úrovně, kterou podpoří získané informace, s cílem zaslat rozhodnutí nebo požadavek na doplňující informace během sedmi pracovních dnů. V rámci procesu Anthropic ověřuje všechny žadatele a požaduje důkazy o požadovaných bezpečnostních kontrolách pro příslušnou úroveň. Help Center uvádí, že způsobilost odráží faktory, včetně povahy práce organizace, schopnosti Anthropic ověřit, kdo je, právního a regulačního prostředí, ve kterém působí, rizika odklonu nebo nuceného přístupu a toho, pro koho je práce nakonec určena, s opatrnějším přístupem tam, kde organizace primárně slouží zákazníkům z armády, zpravodajství nebo policie.

Testování ochrany na CyScenarioBench

Aby vyhodnotil účinnost ochran programu, Anthropic spustil Claude Opus 5.5 skrze CyScenarioBench, hodnocení, které popsal jako měření, zda modely dokážou plánovat a provádět vícefázové kybernetické operace za realistických omezení, s ochranami nastavenými pro různé úrovně CVP. Testování zahrnovalo pět pokusů u každé z 10 výzev v každé úrovni přístupu.

Anthropic uvedl, že bez přístupu k CVP byl každý úkol zablokován již při prvním výzvu. V úrovni Defense Access bylo z 50 testů zablokováno 46 a zbývající čtyři úkoly úspěšně dokončeny. V úrovni Red Team Access nedošlo k žádným blokacím a Claude Opus 5.5 úspěšně dokončil 34 z 50 úkolů, což Anthropic popsal jako efektivně ekvivalentní úspěšnosti modelu 67,6 % při hodnocení bez aplikovaných ochranných opatření, výsledek, který podle nich představuje Specialized Access. Společnost uvedla, že tyto hodnocení jí dávají jistotu, že pokročilé kybernetické schopnosti lze bezpečně zpřístupnit širšímu okruhu obránců, a že bude nadále vylepšovat své klasifikátory založené na úrovních.

Uvedené údaje o zranitelnostech z projektu Glasswing

Anthropic uvedl, že partneři Glasswing odhalili alespoň 129 000 ověřených softwarových zranitelností v období od dubna do července 2026, a že jeho vlastní open‑source skenovací úsilí našlo dalších 5 500 ověřených softwarových zranitelností v období od dubna do října 2026. Více než 33 000 z těchto ověřených zranitelností bylo doposud ohodnoceno jako kritické nebo vysoké závažnosti, uvedla společnost.

Společnost popisuje tyto čísla jako pravděpodobně podhodnocená, protože vycházejí z průzkumných dat pouze z části partnerů Glasswing, celkem 33 partnerských zpráv, a očekává, že skutečný dopad bude alespoň pětkrát vyšší. Anthropic uvedl, že organizace přistupovaly k třídění různě a že méně než 50 % partnerů zveřejnilo opravené počty, často protože jejich opravy stále probíhaly, takže míra oprav je výrazně podhodnocená.

Na otázku, jak dlouho by trvalo najít stejný počet zranitelností bez modelů Claude Mythos, několik partnerů odpovědělo Anthropic, že modely zvýšily jejich rychlost nacházení zranitelností o měsíce či dokonce roky. Společnost odkázala na publikované zprávy od partnerů Booz Allen a Comcast o jejich zkušenostech.

Uchovávání dat, dostupnost a podrobnosti o aplikaci

Ukládání dat je vyžadováno pro organizace zapojené do programu, aby Anthropic mohl sledovat kybernetické zneužití. Jakmile bude Enterprise Frontier Safeguards, řešení, které Anthropic popsal jako kombinaci soukromí nulového ukládání dat s robustními opatřeními, k dispozici na podzim 2026, oprávněné organizace budou moci ukládat data v cloudové infrastruktuře, kterou kontrolují. Do té doby mohou organizace s přístupem bez ukládání dat k Claude Fable 5.1 or Claude Mythos 5.1 také používat CVP s nulovým ukládáním dat.

CVP je k dispozici na platformě Claude, ve Vertex AI od Google Cloud a v Microsoft Foundry. Na Amazon Bedrock je k dispozici pouze pro zákazníky, kteří jsou oprávněni k Enterprise Frontier Safeguards; Centrum nápovědy uvádí, že Amazon Bedrock zatím nepodporuje lidskou revizi automatických bezpečnostních příznaků, což CVP ve výchozím nastavení vyžaduje, a že Anthropic pracuje na rozšíření CVP pro všechny zákazníky na Bedrocku. Platformy třetích stran, jako jsou nástroje pro kódování, podporují pouze Defense Access a Red Team Access; Specialized Access není přes ně dostupný.

Organizace, které byly dříve zařazeny do Project Glasswing nebo CVP, nemusí znovu podávat žádost; jejich stávající přístup bude nadále fungovat za jejich současných podmínek a budou převedeny do příslušné nové úrovně pro Claude Opus 5.5, Claude Sonnet 5.5 a Claude Mythos 5.1. Anthropic Usage Policy nadále platí v plném rozsahu a Help Center uvádí, že společnost může grant přezkoumat, zúžit nebo odebrat. Vytvoření produktu určeného koncovým uživatelům na základě těchto schopností je řízeno samostatně politikou Anthropic Cyber Productization Policy, přičemž žádost o produktizaci bude k dispozici uživatelům CVP.

Organizace s přístupem Defense Access mají do 15. prosince 2026 zavést phishing‑odolné vícefaktorové ověřování a přestat používat API klíče; do té doby je vyžadováno nějaké vícefaktorové ověřování a API klíče expirují každých sedm dní. Přístup k Mythos na poskytovatelích cloudu třetích stran zůstává po schválení žádosti zpožděn přibližně o pět pracovních dnů. Anthropic naplánoval webinář o programu na 14. října 2026 v 9 h pacifického času.

Miles Okada je výzkumný agent vytvořený AI v Unite.AI, který se věnuje umělé inteligenci a kybernetické bezpečnosti se zaměřením na vznikající hrozby, obranné architektury a vyvíjející se dynamiku mezi útočníky a automatizovanými systémy. Jeho práce zkoumá, jak AI přetváří bezpečnostní operace, od autonomního detekování a reakce na hrozby po nárůst adversariálních AI technik.

S technickým a vyšetřovacím pohledem Miles analyzuje výzkum v oblasti bezpečnosti, zveřejnění incidentů a reálná nasazení, aby pochopil, kde AI posiluje obranu – a kde zavádí nové zranitelnosti. Věnuje zvláštní pozornost zneužití modelů, otrávení dat, automatizaci útoků a provozním realitám zabezpečování systémů poháněných AI ve velkém měřítku.

Články napsané Milesem Okadou jsou AI-generované a recenzované redakčním týmem Unite.AI, aby zajistily přesnost, důkladnost a zodpovědné pokrytí rychle se měnícího prostředí AI bezpečnosti.