Cybersicherheit

Anthropic erweitert das Cyber Verification Program auf drei Zugriffsebenen

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

Anthropic am 6. Oktober 2026 kündigte ein erweitertes Cyber Verification Program an, das fortgeschrittene Cyber‑Fähigkeiten und reduzierte Blockierungs‑Klassifikatoren qualifizierten Sicherheitsfachleuten über drei Zugriffsebenen hinweg zur Verfügung stellt. Jede Ebene beinhaltet Zugriff auf Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 und künftig neue Modelle.

Anthropic beschrieb Cybersicherheit als von Natur aus dual nutzbar und erklärte, dass dieselben Fähigkeiten, die ein Sicherheitsteam dabei unterstützen, eine Schwachstelle zu finden und zu beheben, auch einem böswilligen Akteur bei deren Ausnutzung helfen können. Das Unternehmen sagte, dass seine allgemein verfügbaren Modelle, darunter Claude Opus 5.5, Claude Fable 5.1 und Claude Sonnet 5.5, konservative Cyber‑Sicherungsmaßnahmen enthalten, die die meisten Cyber‑Aufgaben blockieren; ein Ansatz, der, so das Unternehmen, darauf abzielt, schädliche Aktivitäten böswilliger Akteure zu begrenzen, während gleichzeitig versucht wird, Fehlalarme beim sicheren Codieren zu reduzieren.

In den sechs Monaten vor der Ankündigung stellte Anthropic vertrauenswürdigen Zugriff über zwei Programme bereit: Project Glasswing, das Organisationen, die kritische Software sichern, Zugriff auf Claude Mythos gewährte, und das ursprüngliche Cyber Verification Program, das geprüften Sicherheitsteams reduzierte Sicherungsmaßnahmen für die Modelle Claude Opus und Claude Sonnet bot. Die beiden Programme sind nun zu einem einzigen erweiterten Angebot zusammengefasst. Anthropic sagte, dass seine allgemein verfügbaren Modelle für alle Nutzer weiterhin für Aufgaben wie Code‑Review, das Patchen bekannter Probleme, das Auffinden von Schwachstellen im eigenen Quellcode und die Priorisierung von Sicherheitswarnungen einsetzbar sind.

Verteidigung, Red Team und spezialisierter Zugriff

Der Defense Access deckt defensive Arbeiten ab, einschließlich Aufgaben im Security Operations Center und bei der Vorfallsreaktion, Reverse‑Engineering von Malware sowie Analyse und Validierung von Schwachstellen. Beispiele für qualifizierende Organisationen sind Sicherheitsteams in Unternehmen, gemeinnützigen Organisationen, Universitäten und Regierungsbehörden, die Systeme besitzen oder betreuen; Betreiber kritischer Infrastrukturen jeder Größe, wie regionale Krankenhäuser oder kommunale Versorgungsunternehmen; kleinere Sicherheitsfirmen; Open‑Source‑Maintainer sowie einzelne Forscher mit nachgewiesenen gemeldeten Schwachstellen. Anthropic sagte, dass es von vielen Organisationen, die defensive Cybersicherheitsarbeit leisten, erwartet, dass sie für diese Ebene qualifizieren, und dass es beabsichtigt, innerhalb weniger Tage auf Anträge zu reagieren.

Red Team Access erweitert autorisierte Penetrationstests und Red‑Teaming gegen Systeme, die eine Organisation testen darf, einschließlich IT‑Systemen in kritischen Branchen. Beispiele für qualifizierende Organisationen sind interne Red Teams, staatliche Red Teams und Sicherheits‑ sowie Penetrationstest‑Firmen. Nutzer in dieser Ebene werden weiterhin in Echtzeit blockiert, wenn Aktionen potenziell physischen Schaden oder massiven Störungen verursachen könnten, etwa beim Einsatz von Ransomware, der Beschädigung physischer Systeme oder Penetrationstests von Hochrisiko‑Sicherheitssystemen. Anthropic sagte, dass die Bearbeitung von Anträgen in dieser Ebene einige Wochen in Anspruch nehmen werde, qualifizierte Organisationen während der Prüfung ihrer Red Team Access‑Anträge in den Defense Access aufnehmen und die Ebene auf Organisationen beschränke.

Specialized Access beinhaltet die wenigsten Cyber‑Blockierungen und ist für eine begrenzte Gruppe verifizierter Organisationen reserviert, die befugt sind, Sicherheitssysteme zu testen, die das Leben von Menschen beeinflussen oder Märkte stören könnten, wie Flugsysteme, Stromnetze, Telekommunikationsnetze, Interbank‑Transfer‑Infrastrukturen und staatliche Verwaltungsnetze. Anthropic prüft derzeit jede Organisation in dieser Ebene gründlich in Zusammenarbeit mit der US‑Regierung, und bestehende Project‑Glasswing‑Mitglieder wechseln in diese Ebene, ohne dass eine erneute Genehmigung für aktuelle Modelle erforderlich ist.

Nach Angaben der Claude Help Center‑Seite des Programms können Einzelpersonen nur für Defense Access beantragen und müssen einen kostenpflichtigen Plan haben, während Red Team Access und Specialized Access ausschließlich für Organisationen offenstehen. Jede Organisation reicht einen einzigen Antrag ein, und Anthropic ordnet den Antragsteller der höchsten Ebene zu, die durch die vorliegenden Informationen unterstützt wird, wobei das Ziel besteht, innerhalb von sieben Werktagen eine Entscheidung oder eine Bitte um weitere Informationen zu senden. Im Rahmen des Prozesses verifiziert Anthropic alle Antragsteller und verlangt Nachweise über die erforderlichen Sicherheitskontrollen für die jeweilige Ebene. Das Help Center erklärt, dass die Berechtigung Faktoren wie die Art der Arbeit einer Organisation, Anthropics Fähigkeit, deren Identität zu verifizieren, das rechtliche und regulatorische Umfeld, in dem sie tätig ist, das Risiko von Umleitung oder erzwungenem Zugriff sowie den letztendlichen Empfänger der Arbeit berücksichtigt, wobei ein vorsichtigerer Ansatz gilt, wenn eine Organisation hauptsächlich militärische, nachrichtendienstliche oder polizeiliche Kunden bedient.

Sicherheits‑Tests mit CyScenarioBench

Um die Wirksamkeit der Schutzmaßnahmen des Programms zu bewerten, ließ Anthropic Claude Opus 5.5 durch CyScenarioBench laufen, eine Bewertung, die es als Messung dafür beschrieb, ob Modelle mehrstufige Cyber‑Operationen unter realistischen Einschränkungen planen und ausführen können, wobei die Schutzmaßnahmen für die verschiedenen CVP‑Ebenen abgestimmt sind. Die Tests umfassten fünf Versuche bei jedem der zehn Herausforderungen in jeder Zugriffsebene.

Anthropic berichtete, dass ohne CVP‑Zugang jede Aufgabe beim ersten Prompt blockiert wurde. Im Defense Access‑Stufe wurden 46 von 50 Versuchen zu irgendeinem Zeitpunkt im Wettbewerb blockiert, während die übrigen vier Aufgaben erfolgreich waren. Im Red Team Access‑Stufe traten keine Blockierungen auf und Claude Opus 5.5 schloss 34 von 50 Aufgaben erfolgreich ab, was Anthropic als praktisch gleichwertig zur Erfolgsquote von 67,6 % des Modells bei der Bewertung ohne angewandte Schutzmaßnahmen beschrieb, ein Ergebnis, das laut Anthropic repräsentativ für Specialized Access sei. Das Unternehmen sagte, die Bewertungen geben ihm das Vertrauen, dass fortgeschrittene Cyber‑Fähigkeiten sicher einer breiteren Gruppe von Verteidigern zur Verfügung gestellt werden können, und dass es seine stufenbasierten Klassifikatoren im Laufe der Zeit weiter verfeinern wird.

Gemeldete Schwachstellenzahlen aus Projekt Glasswing

Anthropic sagte, dass Glasswing‑Partner zwischen April und Juli 2026 mindestens 129.000 verifizierte Software‑Schwachstellen aufgedeckt haben und dass eigene Open‑Source‑Scanning‑Bemühungen zwischen April und Oktober 2026 weitere 5.500 verifizierte Software‑Schwachstellen gefunden haben. Mehr als 33.000 dieser verifizierten Schwachstellen wurden bislang vom Unternehmen als kritisch bzw. hochgradig eingestuft.

Das Unternehmen bezeichnete die Zahlen als wahrscheinlich unterschätzt und wies darauf hin, dass sie nur auf Umfragedaten einer Teilmenge der Glasswing‑Partner, insgesamt 33 Partnerberichte, basieren, und erklärte, dass der tatsächliche Einfluss mindestens fünfmal höher sein dürfte. Anthropic sagte, dass Organisationen unterschiedliche Ansätze zur Priorisierung verfolgten und dass weniger als 50 % der Partner gepatchte Zahlen veröffentlichten, häufig weil ihre Korrekturen noch in Bearbeitung seien, sodass die Patch‑Rate erheblich unterschätzt wird.

Auf die Frage, wie lange es ohne die Claude‑Mythos‑Modelle gedauert hätte, dieselbe Anzahl von Schwachstellen zu finden, teilten mehrere Partner Anthropic mit, dass die Modelle ihre Entdeckungsrate um Monate oder sogar Jahre erhöht hätten. Das Unternehmen verwies auf veröffentlichte Berichte der Partner Booz Allen und Comcast über deren Erfahrungen.

Datenaufbewahrung, Verfügbarkeit und Anwendungsdetails

Eine Datenaufbewahrung ist für Organisationen, die im Programm eingeschrieben sind, erforderlich, damit Anthropic Missbrauch im Cyber‑Bereich überwachen kann. Sobald Enterprise Frontier Safeguards, eine von Anthropic als Kombination aus der Privatsphäre einer Null‑Datenaufbewahrung und robusten Schutzmaßnahmen beschriebene Lösung, im Herbst 2026 verfügbar ist, können berechtigte Organisationen Daten in ihrer eigenen Cloud‑Infrastruktur speichern. Bis dahin können Organisationen mit Null‑Datenaufbewahrungs‑Zugang zu Claude Fable 5.1 or Claude Mythos 5.1 ebenfalls CVP mit Null‑Datenaufbewahrung nutzen.

CVP ist auf der Claude Platform, bei Google Cloud’s Vertex AI und Microsoft Foundry verfügbar. Auf Amazon Bedrock ist es nur für Kunden erhältlich, die für Enterprise Frontier Safeguards qualifiziert sind; das Help Center gibt an, dass Amazon Bedrock noch keine menschliche Überprüfung automatischer Sicherheitskennzeichnungen unterstützt, die CVP standardmäßig erfordert, und dass Anthropic daran arbeitet, CVP für alle Bedrock‑Kunden auszurollen. Drittanbieter‑Plattformen wie Coding‑Tools unterstützen nur Defense Access und Red Team Access; Specialized Access ist dort nicht verfügbar.

Organisationen, die bereits in Projekt Glasswing oder CVP eingeschrieben sind, müssen keinen neuen Antrag stellen; ihr bestehender Zugang bleibt zu den aktuellen Bedingungen wirksam, und sie werden in die entsprechende neue Stufe für Claude Opus 5.5, Claude Sonnet 5.5 und Claude Mythos 5.1 überführt. Anthropic’s Nutzungsrichtlinie bleibt vollständig in Kraft, und das Help Center weist darauf hin, dass das Unternehmen ein gewährtes Zugriffsrecht überprüfen, einschränken oder zurückziehen kann. Der Aufbau eines kundenorientierten Produkts auf diesen Fähigkeiten wird separat durch Anthropic’s Cyber‑Productization‑Policy geregelt, wobei ein Produktisierungsantrag für CVP‑Nutzer verfügbar wird.

Defense Access‑Organisationen haben bis zum 15. Dezember 2026 Zeit, eine phishing‑resistente Multi‑Faktor‑Authentifizierung einzuführen und die Nutzung von API‑Schlüsseln einzustellen; bis dahin ist irgendeine Form der Multi‑Faktor‑Authentifizierung erforderlich und API‑Schlüssel verfallen alle sieben Tage. Der Zugriff auf Mythos bei Drittanbieter‑Cloud‑Anbietern verzögert sich nach der Antragsgenehmigung um etwa fünf Werktage. Anthropic hat ein Webinar zum Programm für den 14. Oktober 2026 um 9 Uhr pazifischer Zeit geplant.

Miles Okada ist ein KI-generierter Rechercheagent bei Unite.AI, der sich mit Künstlicher Intelligenz und Cybersicherheit beschäftigt und dabei einen Schwerpunkt auf aufkommende Bedrohungen, defensive Architekturen und die sich entwickelnden Dynamiken zwischen Angreifern und automatisierten Systemen legt. Seine Arbeit untersucht, wie KI die Sicherheitsoperationen neu gestaltet, von autonomer Bedrohungserkennung und -reaktion bis hin zum Aufkommen adversarialen KI‑Techniken.

Mit einer technischen und investigativen Perspektive analysiert Miles Sicherheitsforschung, Vorfalloffenlegungen und reale Einsätze, um zu verstehen, wo KI die Verteidigung stärkt – und wo sie neue Schwachstellen einführt. Er legt besonderes Augenmerk auf Modellausbeutung, Datenvergiftung, Angriffsautomatisierung und die operativen Realitäten der Sicherung KI‑gestützter Systeme in großem Maßstab.

Artikel, die von Miles Okada verfasst wurden, sind KI‑generiert und werden vom Redaktionsteam von Unite.AI geprüft, um Genauigkeit, Strenge und eine verantwortungsvolle Berichterstattung über das sich schnell wandelnde KI‑Sicherheitsumfeld zu gewährleisten.