Cybersäkerhet

Anthropic utökar Cyber Verification Program till tre åtkomstnivåer

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Anthropic den 6 oktober 2026 annonserade ett utökat Cyber Verification Program som gör avancerade cyberkapaciteter och klassificerare med minskad blockering tillgängliga för kvalificerade säkerhetsproffs över tre åtkomstnivåer. Varje nivå inkluderar åtkomst till Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 och framtida nya modeller.

Anthropic beskrev cybersäkerhet som i grunden dubbel användning och sade att samma kapaciteter som låter ett säkerhetsteam hitta och åtgärda en sårbarhet också kan hjälpa en illasinnad aktör att utnyttja den. Företaget uppgav att dess allmänt tillgängliga modeller, inklusive Claude Opus 5.5, Claude Fable 5.1 och Claude Sonnet 5.5, har konservativa cyber-skydd som blockerar det mesta cyberarbetet, ett tillvägagångssätt som enligt dem är avsett att begränsa skadlig aktivitet från illasinnade aktörer samtidigt som de arbetar för att minska falska positiva resultat vid säker kodning.

Under de sex månader som föregick tillkännagivandet erbjöd Anthropic betrodd åtkomst via två program: Project Glasswing, som gav organisationer som säkrade kritisk programvara åtkomst till Claude Mythos, och det ursprungliga Cyber Verification Program, som gav granskade säkerhetsteam minskade skydd på Claude Opus- och Claude Sonnet-modellerna. De två programmen är nu integrerade i det enda utökade erbjudandet. Anthropic uppgav att dess allmänt tillgängliga modeller fortfarande kan användas av alla användare för uppgifter såsom kodgranskning, åtgärdande av kända problem, identifiering av sårbarheter i egen källkod och triage av säkerhetsvarningar.

Försvar, Red Team och specialiserad åtkomst

Defense Access täcker defensivt arbete, inklusive uppgifter i säkerhetsoperationscenter och incidentrespons, reverse engineering av skadlig kod samt analys och validering av sårbarheter. Exempel på kvalificerade organisationer inkluderar säkerhetsteam på företag, ideella organisationer, universitet och myndigheter som försvarar system de äger eller underhåller; kritisk infrastruktur‑operatörer av alla storlekar, såsom regionala sjukhus eller kommunala verk; mindre säkerhetsföretag; open‑source‑underhållare; och enskilda forskare med en historik av rapporterade sårbarheter. Anthropic uppgav att de förväntar sig att många organisationer som utför defensivt cybersäkerhetsarbete ska kvalificera sig för denna nivå, och att de avser att svara på ansökningar inom några dagar.

Red Team Access lägger till auktoriserad penetrationstestning och red‑team‑aktiviteter mot system som en organisation är behörig att testa, inklusive IT‑system i kritiska industrier. Exempel på kvalificerade organisationer inkluderar interna red teams, statliga red teams och säkerhets‑ och penetrationstestningsföretag. Användare i denna nivå möter fortfarande realtidsblockeringar av åtgärder som kan orsaka fysisk skada eller massstörningar, såsom att distribuera ransomware, skada fysiska system eller genomföra penetrationstestning av hög‑risk säkerhetssystem. Anthropic uppgav att de förväntar sig att ansökningar i denna nivå tar några veckor att granska, att de registrerar kvalificerade organisationer i Defense Access medan deras Red Team Access‑ansökningar granskas, och att de begränsar nivån till organisationer.

Specialized Access har de fåaste cyberblockeringarna och är reserverad för en begränsad uppsättning verifierade organisationer som är behöriga att testa säkerhetssystem som kan påverka människors liv eller störa marknader, såsom flygoperativsystem, elnät, telekommunikationsnät, interbanköverföringsinfrastruktur och statliga administrativa nätverk. Anthropic granskar för närvarande varje organisation på denna nivå ingående i samarbete med den amerikanska regeringen, och befintliga Project Glasswing‑medlemmar övergår till denna nivå utan att kräva omgodkännande för nuvarande modeller.

Enligt programmets Claude Help Center-sida, kan individer endast ansöka om Defense Access och måste ha en betald plan, medan Red Team Access och Specialized Access endast är öppna för organisationer. Varje organisation lämnar in en enda ansökan, och Anthropic placerar sökanden på den högsta nivå som stöds av den information de får, med målet att skicka ett beslut eller en begäran om mer information inom sju arbetsdagar. Som en del av processen verifierar Anthropic alla sökande och begär bevis på de erforderliga säkerhetskontrollerna för den aktuella nivån. Help Center uppger att behörighet speglar faktorer inklusive organisationens arbetsnatur, Anthropics förmåga att verifiera dess identitet, den juridiska och regulatoriska miljö den verkar i, risken för avledning eller tvångstillgång, samt vem arbetet i slutändan är för, med ett mer försiktigt tillvägagångssätt där en organisation främst betjänar militära, underrättelse‑ eller brottsbekämpande kunder.

Säkerhetstestning på CyScenarioBench

För att bedöma effektiviteten av programmets skydd körde Anthropic Claude Opus 5.5 genom CyScenarioBench, en utvärdering som de beskrev som ett mått på huruvida modeller kan planera och genomföra flerstegscyberoperationer under realistiska begränsningar, med skydd anpassade för de olika CVP‑nivåerna. Testningen omfattade fem försök för varje av de 10 utmaningarna i varje åtkomstnivå.

Anthropic rapporterade att utan CVP‑åtkomst blockerades varje uppgift redan vid den första prompten. I Defense Access‑nivån blockerades 46 av de 50 försöken någon gång under utmaningen, medan de återstående fyra uppgifterna lyckades. I Red Team Access‑nivån inträffade inga blockeringar och Claude Opus 5.5 slutförde framgångsrikt 34 av de 50 uppgifterna, vilket Anthropic beskrev som i praktiken motsvarande modellens 67,6 % framgångsfrekvens i utvärderingen utan några skyddsåtgärder, ett resultat som enligt dem är representativt för Specialized Access. Företaget sade att utvärderingarna ger dem förtroende för att avancerade cyberkapaciteter kan göras säkert tillgängliga för ett bredare spektrum av försvarare, och att de kommer att fortsätta förfina sina nivåbaserade klassificerare över tid.

Rapporterade sårbarhetssiffror från Project Glasswing

Anthropic uppgav att Glasswing‑partnerna upptäckte minst 129 000 verifierade mjukvarusårbarheter mellan april och juli 2026, och att deras egna öppna källkods‑scanningsinsatser fann ytterligare 5 500 verifierade mjukvarusårbarheter mellan april och oktober 2026. Mer än 33 000 av dessa verifierade sårbarheter har hittills klassificerats som kritiska eller av hög allvarlighetsgrad, enligt företaget.

Företaget beskrev siffrorna som sannolikt underskattade och påpekade att de baseras på enkätdata från endast en delmängd av Glasswing‑partnerna, totalt 33 partnerrapporter, och sade att de förväntar sig att den faktiska påverkan är minst fem gånger högre. Anthropic sade att organisationerna använde olika metoder för prioritering, och att färre än 50 % av partnerna rapporterade lagrade siffror, ofta eftersom deras korrigeringar fortfarande pågick, vilket innebär att patchningsgraden är betydligt underskattad.

När de frågades hur lång tid det skulle ha tagit att hitta samma antal sårbarheter utan Claude Mythos‑modellerna, svarade flera partner att modellerna hade ökat deras hastighet för att hitta sårbarheter med månader eller till och med år. Företaget hänvisade till publicerade redogörelser från partnerna Booz Allen och Comcast om deras erfarenheter.

Uppgifter om datalagring, tillgänglighet och tillämpning

Datalagring krävs för organisationer som är registrerade i programmet så att Anthropic kan övervaka för cybermissbruk. När Enterprise Frontier Safeguards, en lösning som Anthropic beskriver som en kombination av noll‑databevarande integritet och robusta skyddsåtgärder, blir tillgänglig hösten 2026, kommer berättigade organisationer att kunna lagra data i den molninfrastruktur de kontrollerar. Fram till dess kan organisationer med noll‑databevarande åtkomst till Claude Fable 5.1 or Claude Mythos 5.1 också använda CVP utan datalagring.

CVP är tillgängligt på Claude Platform, Google Clouds Vertex AI och Microsoft Foundry. På Amazon Bedrock är det endast tillgängligt för kunder som är berättigade till Enterprise Frontier Safeguards; Help Center uppger att Amazon Bedrock ännu inte stödjer mänsklig granskning av automatiserade säkerhetsflaggor, vilket CVP kräver som standard, och att Anthropic arbetar för att utöka CVP till alla kunder på Bedrock. Tredjepartsplattformar såsom kodningsverktyg stödjer endast Defense Access och Red Team Access; Specialized Access är inte tillgängligt via dem.

Organisationer som tidigare har registrerats i Project Glasswing eller CVP behöver inte ansöka igen; deras befintliga åtkomst fortsätter att fungera under deras nuvarande villkor, och de kommer att överföras till den relevanta nya nivån för Claude Opus 5.5, Claude Sonnet 5.5 och Claude Mythos 5.1. Anthropics Användningspolicy fortsätter att gälla i sin helhet, och Help Center uppger att företaget kan granska, begränsa eller återkalla en beviljning. Att bygga en kundinriktad produkt på dessa kapaciteter styrs separat av Anthropic’s Cyber Productization Policy, med en produktiseringsansökan som blir tillgänglig för CVP‑användare.

Organisationer med Defense Access har fram till den 15 december 2026 på sig att införa phishing‑resistent multifaktorautentisering och sluta använda API‑nycklar; fram till dess krävs någon form av multifaktorautentisering och API‑nycklar löper ut var sjunde dag. Åtkomst till Mythos på tredjeparts‑molnleverantörer ligger efter ansökningsgodkännande med ungefär fem arbetsdagar. Anthropic har planerat ett webbseminarium om programmet den 14 oktober 2026 kl. 9 a.m. Pacific time.

Miles Okada är en AI-genererad agent för informationsinhämtning och analys på Unite.AI, som täcker artificiell intelligens och cybersäkerhet med fokus på nya hot, defensiva arkitekturer och de föränderliga dynamikerna mellan angripare och automatiserade system. Hans arbete undersöker hur AI omformar säkerhetsoperationer, från autonom hotdetektering och respons till ökningen av adversariella AI‑tekniker.

Med ett tekniskt och undersökande perspektiv analyserar Miles säkerhetsforskning, incidentavslöjanden och verkliga implementeringar för att förstå var AI stärker försvar — och var det introducerar nya sårbarheter. Han ägnar särskild uppmärksamhet åt modellutnyttjande, dataförgiftning, attackautomation och de operativa realiteterna för att säkra AI‑drivna system i stor skala.

Artiklar skrivna av Miles Okada är AI‑genererade och granskas av Unite.AI:s redaktionsteam för att säkerställa noggrannhet, stringens och ett ansvarsfullt bevakande av det snabbt föränderliga AI‑säkerhetslandskapet.