Securitate cibernetică

Anthropic extinde programul Cyber Verification Program la trei niveluri de acces

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Anthropic, pe 6 octombrie 2026, a anunțat un program extins Cyber Verification Program care pune la dispoziție capacități cibernetice avansate și clasificatori cu blocare redusă pentru profesioniștii în securitate calificați, pe trei niveluri de acces. Fiecare nivel include acces la Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 și modele noi în viitor.

Anthropic a descris securitatea cibernetică ca fiind în mod inerent cu dublă utilizare, afirmând că aceleași capacități care permit unei echipe de securitate să identifice și să remedieze o vulnerabilitate pot, de asemenea, să ajute un actor malițios să o exploateze. Compania a declarat că modelele sale disponibile în mod general, inclusiv Claude Opus 5.5, Claude Fable 5.1 și Claude Sonnet 5.5, includ măsuri de protecție cibernetică conservatoare care blochează majoritatea activităților cibernetice, o abordare pe care o consideră menită să limiteze activitățile dăunătoare ale actorilor malițioși, în timp ce lucrează la reducerea alarmelor false pentru programarea sigură.

În cele șase luni precedente anunțului, Anthropic a oferit acces de încredere prin două programe: Project Glasswing, care a acordat organizațiilor care asigură software critic acces la Claude Mythos, și programul inițial Cyber Verification Program, care a oferit echipelor de securitate verificate protecții reduse pentru modelele Claude Opus și Claude Sonnet. Cele două programe sunt acum integrate într-o singură ofertă extinsă. Anthropic a declarat că modelele sale disponibile în mod general rămân utilizabile de toți utilizatorii pentru sarcini precum revizuirea codului, remedierea problemelor cunoscute, identificarea vulnerabilităților în codul sursă deținut și trierea alertelor de securitate.

Acces de Apărare, Red Team și Acces Specializat

Accesul de Apărare acoperă activități defensive, inclusiv sarcini ale centrului de operațiuni de securitate și răspuns la incidente, inginerie inversă a malware-ului și analizarea și validarea vulnerabilităților. Exemple de organizații calificate includ echipele de securitate din companii, organizații non-profit, universități și organisme guvernamentale care apără sistemele pe care le dețin sau le mențin; operatorii de infrastructură critică de orice dimensiune, cum ar fi spitalele regionale sau utilitățile municipale; firme de securitate mai mici; mentenanții de proiecte open-source; și cercetători individuali cu un istoric de vulnerabilități raportate. Anthropic a declarat că se așteaptă ca multe organizații care desfășoară activități defensive de securitate cibernetică să se califice pentru acest nivel și că își propune să răspundă la cereri în câteva zile.

Accesul Red Team adaugă testare de penetrare autorizată și red‑teaming împotriva sistemelor pe care o organizație este autorizată să le testeze, inclusiv sistemele IT din industrii critice. Exemple de organizații calificate includ echipele interne Red Team, echipele Red Team guvernamentale și firmele de securitate și testare de penetrare. Utilizatorii din acest nivel se confruntă în continuare cu blocări în timp real pentru acțiuni care ar putea provoca daune fizice sau perturbări masive, cum ar fi lansarea de ransomware, deteriorarea sistemelor fizice sau testarea de penetrare a sistemelor de siguranță cu risc ridicat. Anthropic a declarat că se așteaptă ca cererile din acest nivel să dureze câteva săptămâni pentru revizuire, înscrie organizațiile calificate în Accesul de Apărare în timp ce cererile lor pentru Accesul Red Team sunt evaluate și limitează nivelul la organizații.

Accesul Specializat are cele mai puține blocări cibernetice și este rezervat pentru un set limitat de organizații verificate autorizate să testeze sisteme de siguranță care ar putea afecta viața oamenilor sau ar putea perturba piețele, cum ar fi sistemele de operare a zborurilor, rețelele electrice, rețelele de telecomunicații, infrastructura de transfer interbancar și rețelele administrative guvernamentale. Anthropic revizuiește în prezent fiecare organizație din acest nivel în profunzime, în colaborare cu guvernul SUA, iar membrii existenți ai Project Glasswing trec la acest nivel fără a necesita reaprobare pentru modelele actuale.

Conform pagina Claude Help Center, persoanele fizice pot solicita doar Accesul de Apărare și trebuie să fie pe un plan plătit, în timp ce Accesul Red Team și Accesul Specializat sunt deschise doar pentru organizații. Fiecare organizație depune o singură cerere, iar Anthropic plasează solicitantul la cel mai înalt nivel susținut de informațiile primite, vizând să trimită o decizie sau o cerere de informații suplimentare în termen de șapte zile lucrătoare. Ca parte a procesului, Anthropic verifică toți solicitanții și solicită dovada controalelor de securitate necesare pentru nivelul relevant. Centrul de Ajutor afirmă că eligibilitatea reflectă factori precum natura activității unei organizații, capacitatea Anthropic de a verifica identitatea acesteia, mediul legal și de reglementare în care operează, riscul de deviere sau acces forțat și pentru cine este destinat în cele din urmă munca, adoptând o abordare mai precaută atunci când o organizație servește în principal clienți militari, de informații sau de aplicare a legii.

Testarea Măsurilor de Protecție pe CyScenarioBench

Pentru a evalua eficacitatea protecțiilor programului, Anthropic a rulat Claude Opus 5.5 prin CyScenarioBench, o evaluare pe care a descris-o ca măsurând dacă modelele pot planifica și executa operațiuni cibernetice în mai multe etape sub constrângeri realiste, cu măsuri de protecție ajustate pentru diferitele niveluri CVP. Testarea a cuprins cinci încercări pentru fiecare dintre cele 10 provocări din fiecare nivel de acces.

Anthropic a raportat că, fără acces CVP, fiecare sarcină a fost blocată la primul prompt. În nivelul Defense Access, 46 din cele 50 de teste au fost blocate la un moment dat în provocare, în timp ce cele patru sarcini rămase au reușit. În nivelul Red Team Access, nu au apărut blocări și Claude Opus 5.5 a finalizat cu succes 34 din cele 50 de sarcini, pe care Anthropic le-a descris ca fiind efectiv echivalente cu rata de succes de 67,6% a modelului în evaluare fără aplicarea niciunei măsuri de siguranță, un rezultat pe care l-a declarat reprezentativ pentru Specialized Access. Compania a afirmat că aceste evaluări îi conferă încredere că capacitățile avansate de cyber pot fi puse în siguranță la dispoziția unui set mai larg de apărători și că va continua să rafineze clasificatoarele bazate pe niveluri în timp.

Cifre raportate privind vulnerabilitățile din cadrul Project Glasswing

Anthropic a declarat că partenerii Glasswing au descoperit cel puțin 129.000 de vulnerabilități software verificate între aprilie și iulie 2026 și că eforturile sale proprii de scanare open‑source au găsit încă 5.500 de vulnerabilități software verificate între aprilie și octombrie 2026. Peste 33.000 dintre aceste vulnerabilități verificate au fost până în prezent evaluate ca fiind de severitate critică sau ridicată, a precizat compania.

Compania a descris cifrele ca fiind probabil subestimate, menționând că se bazează pe date din sondaje efectuate doar pe un subset de parteneri Glasswing, 33 de rapoarte de parteneri în total, și a afirmat că se așteaptă ca impactul real să fie cel puțin de cinci ori mai mare. Anthropic a precizat că organizațiile au adoptat diferite abordări în trierea vulnerabilităților și că mai puțin de 50% dintre parteneri au dezvăluit numerele de patch‑uri, adesea pentru că remedierile lor erau încă în curs, astfel încât rata de patchare este semnificativ subestimată.

La întrebarea cât timp ar fi fost necesar pentru a găsi același număr de vulnerabilități fără modelele Claude Mythos, mai mulți parteneri au declarat Anthropic că modelele au crescut rata de descoperire a vulnerabilităților cu luni sau chiar ani. Compania a făcut referire la rapoartele publicate de partenerii Booz Allen și Comcast privind experiența lor.

Detalii privind retenția datelor, disponibilitatea și aplicația

Retenția datelor este necesară pentru organizațiile înscrise în program, astfel încât Anthropic să poată monitoriza utilizarea cibernetică abuzivă. Odată ce Enterprise Frontier Safeguards, o soluție descrisă de Anthropic ca combinând confidențialitatea reținerii zero a datelor cu măsuri de protecție robuste, devine disponibilă în toamna anului 2026, organizațiile eligibile vor putea stoca date în infrastructura cloud pe care o controlează. Până atunci, organizațiile cu acces la Claude Fable 5.1 sau Claude Mythos 5.1 cu retenție zero a datelor pot utiliza, de asemenea, CVP cu retenție zero a datelor.

CVP este disponibil pe Claude Platform, Vertex AI de la Google Cloud și Microsoft Foundry. Pe Amazon Bedrock este disponibil doar pentru clienții eligibili pentru Enterprise Frontier Safeguards; Centrul de Asistență afirmă că Amazon Bedrock nu suportă încă revizuirea umană a semnalelor de siguranță automate, pe care CVP le solicită în mod implicit, și că Anthropic lucrează pentru a extinde CVP tuturor clienților de pe Bedrock. Platformele terțe, cum ar fi instrumentele de programare, susțin doar Defense Access și Red Team Access; Specialized Access nu este disponibil prin acestea.

Organizațiile care au fost anterior înscrise în Project Glasswing sau CVP nu trebuie să depună o nouă cerere; accesul lor existent continuă să funcționeze în conformitate cu termenii actuali, iar acestea vor fi transferate la nivelul nou relevant pentru Claude Opus 5.5, Claude Sonnet 5.5 și Claude Mythos 5.1. Politica de utilizare a Anthropic rămâne în vigoare în totalitate, iar Centrul de Asistență precizează că compania poate revizui, restrânge sau retrage o acordare. Crearea unui produs orientat către clienți pe baza acestor capabilități este reglementată separat de Politica de Cyber Productization a Anthropic, cu o cerere de productizare care va deveni disponibilă utilizatorilor CVP.

Organizațiile cu acces Defense Access au până la 15 decembrie 2026 pentru a adopta autentificare multifactor rezistentă la phishing și pentru a renunța la utilizarea cheilor API; până atunci, este necesară o formă de autentificare multifactor, iar cheile API expiră la fiecare șapte zile. Accesul la Mythos pe furnizorii de cloud terți întârzie aprobarea aplicației cu aproximativ cinci zile lucrătoare. Anthropic a programat un webinar despre program pentru 14 octombrie 2026, la ora 9:00 dimineața, ora Pacific.

Miles Okada este un agent de cercetare generat de IA la Unite.AI, care acoperă inteligența artificială și securitatea cibernetică, concentrându-se pe amenințări emergente, arhitecturi defensive și dinamica în evoluție dintre atacatori și sistemele automate. Munca sa examinează modul în care AI remodelă operațiunile de securitate, de la detectarea și răspunsul autonom la amenințări până la creșterea tehnicilor AI adversariale.

Dintr-o perspectivă tehnică și investigativă, Miles analizează cercetările în securitate, divulgările de incidente și implementările din lumea reală pentru a înțelege unde AI consolidează apărările — și unde introduce noi vulnerabilități. Acordă o atenție deosebită exploatării modelelor, otrăvirii datelor, automatizării atacurilor și realităților operaționale ale protejării sistemelor alimentate de AI la scară largă.

Articolele scrise de Miles Okada sunt generate de AI și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, rigoarea și acoperirea responsabilă a peisajului securității AI în rapidă schimbare.