Cyberbeveiliging

Anthropic breidt Cyber Verification Program uit tot drie toegangsniveaus

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Anthropic kondigde op 6 oktober 2026 een uitgebreid Cyber Verification Program aan dat geavanceerde cybercapaciteiten en minder blokkerende classifiers beschikbaar maakt voor in aanmerking komende beveiligingsprofessionals via drie toegangsniveaus. Elk niveau omvat toegang tot Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 en toekomstige nieuwe modellen.

Anthropic beschreef cyberbeveiliging als inherent dual‑use en stelde dat dezelfde capaciteiten die een beveiligingsteam in staat stellen een kwetsbaarheid te vinden en te verhelpen, ook een kwaadwillende actor kunnen helpen deze te exploiteren. Het bedrijf zei dat zijn algemeen beschikbare modellen, waaronder Claude Opus 5.5, Claude Fable 5.1 en Claude Sonnet 5.5, conservatieve cyberbeveiligingsmaatregelen bevatten die het merendeel van cyberwerk blokkeren, een aanpak die volgens hen bedoeld is om schadelijke activiteiten van kwaadwillenden te beperken, terwijl ze werken aan het verminderen van valse positieven bij veilig coderen.

In de zes maanden voorafgaand aan de aankondiging bood Anthropic vertrouwde toegang via twee programma’s: Project Glasswing, dat organisaties die kritieke software beveiligen toegang gaf tot Claude Mythos, en het oorspronkelijke Cyber Verification Program, dat gecontroleerde beveiligingsteams verminderde beveiligingsmaatregelen bood op Claude Opus- en Claude Sonnet-modellen. De twee programma’s zijn nu geïntegreerd in één uitgebreid aanbod. Anthropic zei dat zijn algemeen beschikbare modellen bruikbaar blijven voor alle gebruikers voor taken zoals code‑review, het patchen van bekende problemen, het vinden van kwetsbaarheden in eigen broncode en het triëren van beveiligingsmeldingen.

Defense, Red Team en Gespecialiseerde Toegang

Defense Access omvat defensief werk, waaronder taken van een security operations center en incidentrespons, het reverse‑engineeren van malware en het analyseren en valideren van kwetsbaarheden. Voorbeelden van in aanmerking komende organisaties zijn beveiligingsteams bij bedrijven, non‑profitorganisaties, universiteiten en overheidsinstanties die systemen die ze bezitten of onderhouden verdedigen; exploitanten van kritieke infrastructuur van elke omvang, zoals regionale ziekenhuizen of gemeentelijke nutsbedrijven; kleinere beveiligingsbedrijven; open‑source‑onderhouders; en individuele onderzoekers met een staat van dienst in gerapporteerde kwetsbaarheden. Anthropic zei dat het verwacht dat veel organisaties die defensieve cyberbeveiligingswerkzaamheden uitvoeren in aanmerking komen voor dit niveau, en dat ze van plan zijn om binnen enkele dagen op aanvragen te reageren.

Red Team Access voegt geautoriseerde penetratietesten en red‑team‑activiteiten toe tegen systemen die een organisatie mag testen, inclusief IT‑systemen in kritieke sectoren. Voorbeelden van in aanmerking komende organisaties zijn interne red teams, overheids‑red teams en beveiligings‑ en penetratietestbedrijven. Gebruikers in dit niveau ondervinden nog steeds realtime‑blokkades op acties die fysieke schade of massale verstoring kunnen veroorzaken, zoals het inzetten van ransomware, het beschadigen van fysieke systemen of penetratietesten van hoog‑risico‑veiligheidssystemen. Anthropic zei dat het verwacht dat aanvragen voor dit niveau enkele weken in beslag nemen om te beoordelen, kwalificeert organisaties voor Defense Access terwijl hun Red Team Access‑aanvragen worden beoordeeld, en het niveau beperkt tot organisaties.

Specialized Access heeft de minste cyberblokkades en is gereserveerd voor een beperkte groep geverifieerde organisaties die gemachtigd zijn om veiligheidssystemen te testen die het leven van mensen kunnen beïnvloeden of markten kunnen verstoren, zoals vluchtbeheersystemen, stroomnetwerken, telecomnetwerken, interbank‑overdrachtsinfrastructuur en overheidsadministratieve netwerken. Anthropic beoordeelt momenteel elke organisatie op dit niveau grondig in samenwerking met de Amerikaanse overheid, en bestaande leden van Project Glasswing stappen over naar dit niveau zonder dat hergoedkeuring voor de huidige modellen nodig is.

Volgens de Claude Help Center-pagina van het programma mogen individuen alleen voor Defense Access aanvragen en moeten zij een betaald abonnement hebben, terwijl Red Team Access en Specialized Access uitsluitend voor organisaties beschikbaar zijn. Elke organisatie dient één aanvraag in, en Anthropic plaatst de aanvrager op het hoogste niveau dat wordt ondersteund door de ontvangen informatie, met als doel binnen zeven werkdagen een beslissing of een verzoek om meer informatie te sturen. Als onderdeel van het proces verifieert Anthropic alle aanvragers en vraagt bewijs van de vereiste beveiligingscontroles voor het betreffende niveau. Het Help Center stelt dat de geschiktheid wordt bepaald door factoren zoals de aard van het werk van een organisatie, Anthropic’s vermogen om te verifiëren wie ze is, de juridische en regelgevende omgeving waarin ze opereert, het risico op afleiding of gedwongen toegang, en voor wie het werk uiteindelijk bestemd is, met een voorzichtiger benadering wanneer een organisatie voornamelijk militaire, inlichtingen- of wetshandhavingsklanten bedient.

Beveiligingstesten op CyScenarioBench

Om de effectiviteit van de beschermingsmaatregelen van het programma te beoordelen, heeft Anthropic Claude Opus 5.5 door CyScenarioBench laten lopen, een evaluatie die zij beschreef als het meten of modellen multi‑stage cyberoperaties kunnen plannen en uitvoeren onder realistische beperkingen, met beveiligingsmaatregelen afgestemd op de verschillende CVP‑niveaus. De tests omvatten vijf pogingen per van de 10 uitdagingen in elk toegangsniveau.

Anthropic meldde dat zonder CVP-toegang elke taak werd geblokkeerd bij de eerste prompt. In de Defense Access-tier werden 46 van de 50 proeven op enig moment tijdens de uitdaging geblokkeerd, terwijl de overige vier taken slaagden. In de Red Team Access-tier traden geen blokkeringen op en Claude Opus 5.5 voltooide succesvol 34 van de 50 taken, wat Anthropic beschreef als feitelijk gelijkwaardig aan het succespercentage van 67,6 % van het model bij de evaluatie zonder toegepaste beveiligingsmaatregelen, een resultaat dat volgens hen representatief is voor Specialized Access. Het bedrijf zei dat de evaluaties hen vertrouwen geven dat geavanceerde cybercapaciteiten veilig beschikbaar kunnen worden gesteld aan een bredere groep verdedigers, en dat ze hun op tiers gebaseerde classifiers in de loop der tijd blijven verfijnen.

Gerapporteerde kwetsbaarheidscijfers van Project Glasswing

Anthropic zei dat Glasswing-partners tussen april en juli 2026 minstens 129.000 geverifieerde softwarekwetsbaarheden hebben ontdekt, en dat hun eigen open‑source scaninspanningen tussen april en oktober 2026 nog eens 5.500 geverifieerde softwarekwetsbaarheden hebben gevonden. Meer dan 33.000 van deze geverifieerde kwetsbaarheden zijn tot nu toe als kritiek of hoog geclassificeerd, aldus het bedrijf.

Het bedrijf beschreef de cijfers als waarschijnlijk ondergerapporteerd, en merkte op dat ze gebaseerd zijn op enquêtegegevens van slechts een deel van de Glasswing-partners, in totaal 33 partnerrapporten, en zei dat men verwacht dat de werkelijke impact minstens vijf keer zo groot is. Anthropic stelde dat organisaties verschillende benaderingen van triage hanteerden, en dat minder dan 50 % van de partners gepatchte aantallen openbaar maakte, vaak omdat hun oplossingen nog in uitvoering waren, waardoor het patchpercentage aanzienlijk ondergerapporteerd is.

Toen men hen vroeg hoe lang het zou hebben geduurd om hetzelfde aantal kwetsbaarheden te vinden zonder Claude Mythos-modellen, vertelden verschillende partners Anthropic dat de modellen hun snelheid van kwetsbaarheidsdetectie met maanden of zelfs jaren hadden verhoogd. Het bedrijf verwees naar gepubliceerde verslagen van partners Booz Allen en Comcast over hun ervaring.

Gegevensretentie, beschikbaarheid en toepassingsdetails

Gegevensretentie is vereist voor organisaties die zich voor het programma hebben aangemeld, zodat Anthropic misbruik kan monitoren. Zodra Enterprise Frontier Safeguards, een oplossing die Anthropic beschrijft als een combinatie van de privacy van nul‑gegevensretentie met robuuste beveiligingsmaatregelen, beschikbaar is in het najaar van 2026, kunnen in aanmerking komende organisaties data opslaan in cloudinfrastructuur die zij beheersen. Tot die tijd kunnen organisaties met nul‑gegevensretentie‑toegang tot Claude Fable 5.1 or Claude Mythos 5.1 ook CVP gebruiken met nul‑gegevensretentie.

CVP is beschikbaar op het Claude Platform, Google Cloud’s Vertex AI en Microsoft Foundry. Op Amazon Bedrock is het alleen beschikbaar voor klanten die in aanmerking komen voor Enterprise Frontier Safeguards; het Help Center stelt dat Amazon Bedrock nog geen menselijke beoordeling van geautomatiseerde veiligheidswaarschuwingen ondersteunt, wat CVP standaard vereist, en dat Anthropic werkt aan het uitbreiden van CVP naar alle klanten op Bedrock. Derde‑partijplatformen, zoals programmeertools, ondersteunen alleen Defense Access en Red Team Access; Specialized Access is daar niet beschikbaar.

Organisaties die eerder waren ingeschreven voor Project Glasswing of CVP hoeven zich niet opnieuw aan te melden; hun bestaande toegang blijft werken onder hun huidige voorwaarden, en ze worden overgezet naar de relevante nieuwe tier voor Claude Opus 5.5, Claude Sonnet 5.5 en Claude Mythos 5.1. Anthropic’s Usage Policy blijft volledig van kracht, en het Help Center stelt dat het bedrijf een grant kan herzien, beperken of intrekken. Het bouwen van een klantgerichte product op deze mogelijkheden wordt afzonderlijk geregeld door Anthropic’s Cyber Productization Policy, met een productisatie‑aanvraag die beschikbaar zal worden voor CVP‑gebruikers.

Defense Access‑organisaties hebben tot 15 december 2026 de tijd om phishing‑bestendige multi‑factor authenticatie te implementeren en te stoppen met het gebruik van API‑sleutels; tot die datum is enige vorm van multi‑factor authenticatie vereist en verlopen API‑sleutels elke zeven dagen. Toegang tot Mythos bij cloudproviders van derden volgt de goedkeuring van de aanvraag met ongeveer vijf werkdagen. Anthropic heeft een webinar over het programma gepland voor 14 oktober 2026 om 9.00 uur Pacific‑tijd.

Miles Okada is een AI-gegenereerde onderzoeksagent bij Unite.AI, die kunstmatige intelligentie en cyberbeveiliging behandelt met een focus op opkomende bedreigingen, defensieve architecturen en de zich ontwikkelende dynamiek tussen aanvallers en geautomatiseerde systemen. Zijn werk onderzoekt hoe AI de beveiligingsoperaties hervormt, van autonome dreigingsdetectie en -respons tot de opkomst van adversariale AI-technieken.

Met een technische en onderzoekende benadering analyseert Miles beveiligingsonderzoek, incidentmeldingen en real-world-implementaties om te begrijpen waar AI de verdediging versterkt — en waar het nieuwe kwetsbaarheden introduceert. Hij besteedt bijzondere aandacht aan modeluitbuiting, data-vergiftiging, aanvalautomatisering en de operationele realiteit van het beveiligen van AI-aangedreven systemen op schaal.

Artikelen geschreven door Miles Okada worden AI-gegenereerd en beoordeeld door het redactieteam van Unite.AI om nauwkeurigheid, strengheid en verantwoorde berichtgeving over het snel veranderende AI-beveiligingslandschap te waarborgen.