Cybersäkerhet

Anthropic lanserar Claude Mythos 5 i säkerhetsverktyg, $35M open‑source‑fond

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Anthropic meddelade den 21 augusti 2026 att Claude Mythos 5, den cyber‑kapabla modell som de har begränsat till granskade försvarare sedan april 2026, nu kör sårbarhetsskanningar i Claude Security för företagskunder. Samma tillkännagivande presenterar planer på att integrera Mythos 5 i säkerhetspartnernas produkter, avsätter $35 million i krediter till en ny fond för open‑source‑försvar, och ger en förhandsvisning av en utvidgning av företagets Cyber Verification Program mot Mythos‑klass åtkomst.

Stegen markerar den tredje fasen av en utrullning som Anthropic medvetet har hållit långsam. Företagets resonemang, som redovisas i meddelandet, är att faran koncentreras där en användare har direkt åtkomst till modellen och kan försöka styra den mot offensivt arbete. När användare endast kan få ”specifika resultat, såsom en patch för en sårbarhet eller en säkerhetsvarning”, hävdar Anthropic att risken minskar avsevärt, så expansionen breddar åtkomsten till defensiva resultat samtidigt som skyddsmekanismerna kring själva modellen behålls.

Fyra konkreta förändringar utgör meddelandet. Företagskunder kan nu köra Claude Security‑skanningar på Mythos 5; Anthropic samarbetar med cybersäkerhetsteknik‑ och tjänstepartners för att integrera modellen i verktyg som försvarare redan använder; den nya Defender Advantage Fund (0xDAF) kommer att distribuera $35 million i Claude‑krediter till organisationer som säkrar öppen källkod; och Cyber Verification Program, som för närvarande ger granskade organisationer reducerade skydd på Claude Opus‑ och Sonnet‑modeller, kommer inom de kommande veckorna att utökas för att omfatta bredare dubbelanvändningsmöjligheter på dessa modeller, med Mythos‑klass åtkomst som följer.

Hur Claude Security levererar Mythos 5 utan att öppna modellen

Claude Security är i offentlig beta för Claude Enterprise‑kunder, och Anthropic säger att skanningar med Mythos 5 faktureras som standard token‑användning enligt befintliga planer, utan någon separat tilläggstjänst. Administratörer aktiverar funktionen i admin‑konsolen; från claude.ai/security väljer en användare ett kodförråd, och modellen skannar kodbasen för sårbarheter. Varje fynd returneras med en CWE (Common Weakness Enumeration)‑kategori, förtroende‑ och allvarlighetsbedömning samt ett föreslaget fix. Användaren öppnar sedan Claude Code i webbläsaren för att implementera patchen, och varje patch måste granskas och godkännas av en människa innan den tas i bruk.

Avgränsningen är kärnan. Mythos 5‑skanningen returnerar detaljerade fynd snarare än råa modellutdata, och att köra en sådan utökar inte Mythos‑åtkomsten till någon annan yta: interaktiv patchning använder de modeller som organisationen redan har i Claude Code. Partnerintegrationer följer samma mönster. En slutanvändare av en partnerprodukt uppmanar aldrig Mythos 5 direkt; ett specialbyggt gränssnitt kör modellen i bakgrunden för en definierad uppgift och returnerar endast den avsedda artefakten, till exempel en lista med föreslagna patchar. Anthropic säger att de och deras partners kör missbruksskyddsåtgärder för att hålla modellen inom den ramen, och leverantörer som bygger säkerhetsprodukter kan registrera intresse i integrationsprogrammet.

Partnerkanalen bygger på ett ekosystem som Anthropic har byggt upp sedan maj 2026, då de rapporterade att företag som Wiz, Palo Alto Networks (PANW ), CrowdStrike (CRWD ) och Accenture hade byggt cyberprodukter på Claude Opus. De tidiga siffrorna i det inlägget är företagets egna rapporteringar snarare än oberoende mätningar, men de beskriver marknadens form: Wiz uppgav att deras Opus‑drivna offensiva testningsagent körs kontinuerligt över mer än 150 000 produktionsresurser per vecka, och Accenture sade att de ökade säkerhetstestningsomfånget från cirka 10 % till över 80 % över 1 600 applikationer samtidigt som de minskade skanningsledtiden från 3–5 dagar till under en timme. CrowdStrikes konsultchef Mark Manglicmot, vars företag säljer en Opus‑baserad beredskapstjänst, formulerade partnerfallet så här: ”Frontier‑modeller som Anthropics Claude Opus ger försvarare en kapacitetsfördel som inte fanns för ett år sedan, och driver sårbarhetshanteringen hela vägen till vänster.”

Palo Alto Networks har nyligen rekryterat Anthropic, OpenAI och leverantörer av industriell kontroll för kritisk infrastrukturförsvar, och leverantörer som Harness har börjat leverera agenter som skannar, triagerar och patchar sårbarheter i maskinhastighet.

Från Project Glasswing till en bredare försvararutrullning

Anthropics försiktighet med denna modellklass går tillbaka till Project Glasswing, som lanserades den 7 april 2026 med en koalition vars medlemmar inkluderade Amazon Web Services, Microsoft, Google, CrowdStrike och Linux Foundation. Projektet placerade Claude Mythos Preview i händerna på en liten grupp som säkrade kritisk mjukvara, med stöd av upp till $100 million i användningskrediter och $4 million i direkta donationer till open‑source‑säkerhetsorganisationer. Anthropic sade att Mythos Preview redan hade hittat tusentals högallvarliga sårbarheter, inklusive några i varje större operativsystem och webbläsare: ett 27‑årigt fjärrutlösligt fel i OpenBSD, ett 16‑årigt fel i en FFmpeg‑rad som automatiserad testning hade träffat fem miljoner gånger utan att fånga, och en kedjad Linux‑kärnprivilegieeskalering. Alla tre rapporterades till underhållare och patchades innan offentliggörande. Programmet fortsatte att lägga till deltagare under sommaren, med säkerhetsföretag som Horizon3.ai som gick med i sårbarhetsjakten i juli 2026.

Den 9 juni 2026 delade Anthropic modellen i två för sin Fable 5 och Mythos 5 lansering. Claude Fable 5 är samma underliggande modell med säkerhetsklassificerare som dirigerar cyber‑, biologi‑ och destilleringsrelaterade förfrågningar till Claude Opus 4.8 istället; den gick i allmän tillgänglighet. Claude Mythos 5, med cyber‑skydden borttagna för granskade användare, gick till Glasswing‑partnerna till $10 per miljon inmatningstoken och $50 per miljon utmatningstoken, mindre än hälften av priset för Mythos Preview. Anthropic uppgav att ett externt felbelöningsprogram inte producerade några universella jailbreaks under mer än 1 000 timmars testning, och de har fortsatt att finjustera klassificerarna sedan: tidigare i augusti 2026 omjusterade de Fable 5:s biologiska skydd, vilket minskade blockerade förfrågningar med 85 %. Trafik på Mythos‑klassmodeller har ett 30‑dagars lagringskrav, vilket Anthropic säger används för säkerhetsändamål och inte för träning.

Anthropics satsning på cyberförsvar i siffror

  • $35 million i Claude‑krediter avsatta till Defender Advantage Fund (0xDAF), för att patcha levande sårbarheter i allmänt använda open‑source‑projekt, automatisera skanning och patchning på sätt som andra projekt kan replikera, samt metoder som gör projekt motståndskraftiga mot hela klasser av attacker
  • $100 million i användningskrediter avsatta till Project Glasswing i april 2026, plus $4 million i direkta donationer: $2.5 million till Alpha‑Omega och OpenSSF genom Linux Foundation, och $1.5 million till Apache Software Foundation
  • $10 per million input tokens and $50 per million output tokens för Mythos 5, jämfört med $25 och $125 för Mythos Preview
  • More than 40 ytterligare organisationer som underhåller kritisk mjukvaruinfrastruktur får åtkomst utöver Glasswings 12 lanseringspartner
  • 83.1% versus 66.6%: Mythos Preview mot Opus 4.6 på CyberGym‑sårbarhetsreproduktion, enligt mätningar och rapportering från Anthropic själva

Fonden bygger vidare på arbete som Anthropic säger att Glasswing redan har påbörjat, inklusive stöd för koordinerade sårbarhetsfixningsinsatser som Akrites och Vita husets Gold Eagle‑initiativ. Den inleds med ett litet antal större pilotbidrag medan Anthropic lär sig vad som kan skalas.

Vad som kommer härnäst för Mythos‑klass åtkomst

De kortsiktiga milstolparna är alla schemalagda. Anthropic säger att under de kommande veckorna kommer Cyber Verification Program att utökas: defensiva funktioner som sårbarhetstriage och validering flyttas till Mythos‑klassmodeller, och registrerade försvarare kommer att se färre blockeringar på Opus och Sonnet. Organisationer som redan har accepterats behöver inte vidta någon åtgärd; Anthropic meddelar att de kommer att kontakta dem med uppdateringar. De första mottagarna av Defender Advantage Fund kommer att namnges under de kommande veckorna när pilotbidragen beviljas, och partnerintegrationer som för in Mythos 5 i kommersiella säkerhetsprodukter beskrivs som tidigt arbete som företaget förväntar sig att expandera över tid. Parallellt säger Anthropic att de breddar Mythos‑åtkomsten genom Project Glasswing med amerikanska regeringspartner, riktat mot operatörer av kritisk infrastruktur som uppfyller strikta säkerhetskontrollkrav.

Claude Security förblir i offentlig beta för företagskunder, med Mythos 5‑skanningar i drift från och med den 21 augusti 2026 och faktureras som standard token‑användning enligt befintliga planer.

Miles Okada är en AI-genererad analytiker på Unite.AI, som täcker artificiell intelligens och cybersäkerhet med fokus på nya hot, defensiva arkitekturer och de föränderliga dynamikerna mellan angripare och automatiserade system. Hans arbete undersöker hur AI omformar säkerhetsoperationer, från autonom hotdetektering och respons till uppkomsten av adversarial AI-tekniker.
Med en teknisk och undersökande perspektiv analyserar Miles säkerhetsforskning, incidentrapporter och verkliga distributioner för att förstå var AI stärker försvar - och var den introducerar nya sårbarheter. Han ägnar särskild uppmärksamhet åt modellutnyttjande, dataförgiftning, attackautomatisering och de operativa realiteterna för att skydda AI-drivna system i stor skala.
Artiklar skrivna av Miles Okada är AI-genererade och granskade av Unite.AIs redaktionella team för att säkerställa noggrannhet, stränghet och ansvarsfull rapportering av den snabbt föränderliga AI-säkerhetslandskapet.