Securitate cibernetică

Anthropic lansează Claude Mythos 5 în instrumente de securitate, fond de 35 milioane de dolari pentru open‑source

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Anthropic a declarat pe 21 august 2026 că Claude Mythos 5, modelul cu capabilităţi cibernetice pe care l‑a limitat la apărători verificaţi din aprilie 2026, rulează acum scanări de vulnerabilităţi în Claude Security pentru clienţii Enterprise. Acelaşi anunţ prezintă planuri de a integra Mythos 5 în produsele partenerilor de securitate, alocă 35  milioane de dolari în credite către un nou fond pentru apărare open‑source şi oferă o previzualizare a extinderii Programului de Verificare Cibernetică al companiei spre acces de tip Mythos.

Aceste mişcări marchează a treia etapă a unei lansări pe care Anthropic a ales să o menţină deliberat lentă. Motivaţia companiei, expusă în anunţ, este că pericolul se concentrează acolo unde un utilizator are acces direct la model şi poate încerca să îl îndrepte spre activităţi ofensive. Când utilizatorii pot primi doar „rezultate specifice, cum ar fi un patch pentru o vulnerabilitate sau o alertă de securitate”, susţine Anthropic, riscul scade considerabil, aşa că extinderea lărgeşte accesul la rezultate defensive menţinând în acelaşi timp barierele în jurul modelului în sine.

Patru schimbări concrete alcătuiesc anunţul. Clienţii Enterprise pot acum să ruleze scanări Claude Security pe Mythos 5; Anthropic colaborează cu parteneri de tehnologie şi servicii de securitate cibernetică pentru a încorpora modelul în instrumentele pe care apărătorii le folosesc deja; noul Defender Advantage Fund (0xDAF) va distribui 35  milioane de dolari în credite Claude către organizaţiile care securizează software‑ul open‑source; iar Programul de Verificare Cibernetică, care în prezent oferă organizaţiilor verificate protecţii reduse pe modelele Claude Opus şi Sonnet, se va extinde în săptămânile următoare pentru a acoperi capabilităţi dual‑use mai largi pe aceleaşi modele, urmat de acces de tip Mythos.

Cum Claude Security livrează Mythos 5 fără a deschide modelul

Claude Security este în beta publică pentru clienţii Claude Enterprise, iar Anthropic afirmă că scanările cu Mythos 5 sunt facturate ca utilizare standard de tokeni în cadrul planurilor existente, fără un supliment separat. Administratorii activează funcţia în consola de administrare; de la claude.ai/security, un utilizator alege un depozit, iar modelul scanează baza de cod pentru vulnerabilităţi. Fiecare constatare este însoţită de o categorie CWE (Common Weakness Enumeration), de ratinguri de încredere şi severitate şi de o soluţie sugerată. Utilizatorul apoi deschide Claude Code pe web pentru a implementa patch‑ul, iar fiecare patch trebuie revizuit şi aprobat de un om înainte de a fi aplicat.

Definirea limitelor este esenţială. Scanarea Mythos 5 returnează constatări detaliate în loc de ieşiri brute ale modelului, iar rularea uneia nu extinde accesul la Mythos pe alte suprafeţe: patch‑area interactivă foloseşte oricare modele pe care organizaţia le are deja în Claude Code. Integrarea partenerilor urmează acelaşi model. Un utilizator final al unui produs partener nu solicită niciodată direct Mythos 5; o interfaţă construită special rulează modelul în fundal pentru o sarcină definită şi returnează doar artefactul dorit, cum ar fi o listă de patch‑uri sugerate. Anthropic declară că el şi partenerii săi aplică măsuri de prevenire a abuzului pentru a menţine modelul în cadrul acestor limite, iar furnizorii care dezvoltă produse de securitate pot înregistra interesul pentru programul de integrare.

Canalul de parteneriat se bazează pe un ecosistem pe care Anthropic îl construieşte din mai bine de un an, începând cu mai 2026, când a raportat că firme precum Wiz, Palo Alto Networks (PANW ), CrowdStrike (CRWD ) şi Accenture au dezvoltat produse cibernetice pe Claude Opus. Datele timpurii din acel articol sunt furnizate de companii, nu măsurate independent, dar descriu forma pieţei: Wiz a afirmat că agentul său de testare ofensivă bazat pe Opus rulează continuu pe peste 150 000 de active de producţie pe săptămână, iar Accenture a declarat că a crescut acoperirea testării de securitate de la aproximativ 10 % la peste 80 % pe 1 600 de aplicaţii, reducând timpul de scanare de la 3‑5 zile la sub o oră. Șeful de consultanţă al CrowdStrike, Mark Manglicmot, al cărui grup vinde un serviciu de pregătire bazat pe Opus, a descris cazul parteneriatului astfel: „Modelele de frontieră precum Claude Opus de la Anthropic oferă apărătorilor un avantaj de capabilitate care nu exista acum un an, împingând managementul vulnerabilităţilor complet spre stânga.”

Palo Alto Networks a recrutat recent Anthropic, OpenAI şi furnizori de control industrial pentru apărarea infrastructurii critice, iar furnizori precum Harness au început să livreze agenţi care scanează, triagează şi repară vulnerabilităţi la viteza mașinilor.

De la Project Glasswing la o implementare mai largă a Defender

Prudenţa Anthropic faţă de această clasă de modele datează de la Project Glasswing, lansat pe 7 aprilie 2026 cu o coaliţie al cărei membri includeau Amazon Web Services, Microsoft, Google, CrowdStrike şi Linux Foundation. Proiectul a pus Claude Mythos Preview în mâinile unui grup restrâns care securizează software‑ul critic, susţinut de până la 100  milioane de dolari în credite de utilizare şi 4  milioane de dolari în donaţii directe către organizaţii de securitate open‑source. Anthropic a afirmat că Mythos Preview a descoperit deja mii de vulnerabilităţi de severitate ridicată, inclusiv unele în fiecare sistem de operare major şi browser web: o vulnerabilitate de 27 de ani, declanşabilă de la distanţă, în OpenBSD, un bug de 16 ani într‑o linie FFmpeg pe care testele automate l‑au întâlnit de cinci milioane de ori fără a fi prins, şi o escaladare de privilegii în lanţ pe nucleul Linux. Toate trei au fost raportate dezvoltatorilor şi reparate înainte de divulgare. Programul a continuat să adauge participanţi pe parcursul verii, cu firme de securitate precum Horizon3.ai alăturându‑se vânătorii de vulnerabilităţi în iulie 2026.

Pe 9 iunie 2026, Anthropic a împărţit modelul în două pentru lansarea Fable 5 şi Mythos 5. Claude Fable 5 este acelaşi model de bază cu clasificatori de siguranţă care direcţionează întrebări legate de cyber, biologie şi distilare către Claude Opus 4.8; a ajuns la disponibilitate generală. Claude Mythos 5, cu protecţiile cibernetice ridicate pentru utilizatori verificaţi, a fost pus la dispoziţia partenerilor Glasswing la 10 $ pe milion de tokeni de intrare şi 50 $ pe milion de tokeni de ieşire, mai puţin de jumătate din preţul Mythos Preview. Anthropic a declarat că un program extern de recompense pentru buguri nu a produs jailbreak‑uri universale în peste 1 000 de ore de testare şi că a continuat să ajusteze clasificatorii de atunci: la începutul lui august 2026 a recalibrat protecţiile de biologie ale Fable 5, reducând interogările blocate cu 85 %. Traficul pe modelele de tip Mythos are o cerinţă de păstrare de 30 de zile, pe care Anthropic susţine că este folosită în scopuri de siguranţă, nu pentru antrenare.

Impulsul de apărare cibernetică al Anthropic, în cifre

  • $35 million în credite Claude alocate Fondului Defender Advantage (0xDAF), pentru repararea vulnerabilităţilor live în proiecte open‑source larg utilizate, automatizarea scanării şi reparării în moduri ce pot fi replicate de alte proiecte şi abordări care fac proiectele rezistente la întregi clase de atacuri
  • $100 million în credite de utilizare alocate Project Glasswing în aprilie 2026, plus 4 million de dolari în donații directe: 2,5 million de dolari către Alpha‑Omega şi OpenSSF prin Linux Foundation şi 1,5 million de dolari către Apache Software Foundation
  • 10 $ pe milion de tokeni de intrare și 50 $ pe milion de tokeni de ieșire pentru Mythos 5, comparativ cu 25 $ și 125 $ pentru Mythos Preview
  • Mai mult de 40 de organizații suplimentare care mențin infrastructura software critică au primit acces dincolo de cei 12 parteneri de lansare ai Glasswing
  • 83,1% versus 66,6%: Mythos Preview față de Opus 4.6 în reproducerea vulnerabilităților CyberGym, conform măsurătorilor și rapoartelor Anthropic

Fondul extinde activitatea pe care Anthropic susţine că Glasswing a început deja, inclusiv sprijin pentru eforturi coordonate de reparare a vulnerabilităţilor precum Akrites și iniţiativa Gold Eagle a Casei Albe. Începe cu un număr mic de granturi pilot mai mari, în timp ce Anthropic învaţă ce se poate scala.

Ce urmează pentru accesul de tip Mythos

Obiectivele pe termen scurt sunt toate programate. Anthropic afirmă că în săptămânile următoare Programul de Verificare Cibernetică se va extinde: capabilităţi defensive precum trierea şi validarea vulnerabilităţilor vor trece la modelele de tip Mythos, iar apărătorii înscrişi vor vedea blocări reduse pe Opus şi Sonnet. Organizaţiile deja acceptate nu trebuie să întreprindă nicio acţiune; Anthropic spune că va comunica actualizări. Beneficiarii iniţiali ai Defender Advantage Fund vor fi numiţi în săptămânile următoare, pe măsură ce granturile pilot se finalizează, iar integrările partenerilor care aduc Mythos 5 în produse comerciale de securitate sunt descrise ca un prim pas pe care compania îl aşteaptă să îl extindă în timp. În paralel, Anthropic declară că lărgeşte accesul la Mythos prin Project Glasswing alături de parteneri guvernamentali din SUA, vizând operatorii de infrastructură critică care îndeplinesc cerinţe stricte de control al securităţii.

Claude Security rămâne în beta publică pentru clienţii Enterprise, cu scanări Mythos 5 disponibile în direct din 21 august 2026 și facturate ca utilizare standard de tokeni în cadrul planurilor existente.

Miles Okada este un analist generat de IA la Unite.AI, care acoperă inteligența artificială și securitatea cibernetică, cu accent pe amenințările emergente, arhitecturile defensive și dinamica în schimbare între atacatori și sisteme automate. Lucrările sale examinează modul în care IA remodelează operațiunile de securitate, de la detectarea și răspunsul la amenințări autonome până la apariția tehnicilor de IA adversă.

Cu o perspectivă tehnică și de investigație, Miles analizează cercetarea de securitate, divulgarea incidentelor și implementările din lumea reală pentru a înțelege unde IA consolidează apărarea și unde introduce vulnerabilități noi. El acordă o atenție deosebită exploatarea modelului, otrăvirea datelor, automatizarea atacurilor și realitățile operaționale de securizare a sistemelor alimentate de IA la scară largă.

Articolele scrise de Miles Okada sunt generate de IA și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, rigurozitatea și acoperirea responsabilă a peisajului în schimbare rapid al securității IA.