Cybersikkerhet
FBI forventer at motstandere vil bruke Frontier AI på programvarefeil

Den amerikanske etaten som etterforsker de fleste datamaskininnbrudd i USA behandler nå autonom feiloppsporing som en kommende påtaleproblematikk. Todd Hemmen, nestleder for FBI Cyber Divisions Cyber Capabilities Branch, fortalte Digital Government Institutes 930gov-konferanse i Washington den 28. juli 2026 at programvarefeilene som ble avdekket av Anthropics Mythos-modell befinner seg i koden som nesten alt annet avhenger av: operativsystemer, sikkerhetsteknologi, web-infrastruktur og kryptering. “Dette presenterer fremtidige utfordringer for lovens håndheving”, sa han i en uttalelse.
Dette rammeverket er viktig fordi FBI er den ledende føderale etaten for datamaskininnbruddssaker, så deres saksmengde er der kapabilitetsendringen til slutt viser seg som anklaget adferd. Hemmen sa at byrået ikke har sett denne kapabiliteten brukt mot ofre i industriell skala, og forventer ikke at dette vil vare. “Selv om vi ikke har sett dette i bruk i stor skala, er forventningen at det er en fremtidig dato hvor dette kommer”, sa han.
Hans praktiske bekymring er tilskrivning. Når feilfinning slutter å kreve sjeldent ekspertise, utvides bassen av plausibler mistenkte, og etterforskningene blir vanskeligere å snevre inn. Mythos 5 er kun tilgjengelig for en gruppe amerikanske organisasjoner godkjent av regjeringen, men den deler sin underliggende modell med den bredt solgte Claude Fable 5, og Anthropics egen testing fant at svakere, bredt tilgjengelige modeller kunne finne samme feil som utløste en føderal inngripen i juni 2026.
Hva Mythos fant i kritisk kode
Anthropics Frontier Red Team offentliggjorde sin vurdering av modellens sikkerhetskapasiteter den 7. april 2026. Den rapporterte at modellen identifiserte og utnyttet tidligere ukjente feil i alle større operativsystemer og nettlesere når den ble dirigert til det, inkludert en 27 år gammel feil i OpenBSD som lot en angriper krasje enhver maskin som svarte på nettverkstrafikk, og en 16 år gammel feil i FFmpeg-video biblioteket som hadde overlevd år med automatisert testing. I ett tilfelle fant modellen en fjernfeil i FreeBSDs nettverksfilserver og skrev en fungerende rot-eksploit for det uten menneskelig hjelp.
To detaljer setter skalaen for regulatorer. Anthropic sa at færre enn 1% av feilene de hadde funnet var fullstendig fikset på tidspunktet for offentliggjøringen, så de offentliggjorte eksemplene representerer en gulv snarere enn en total. Og økonomien er uanselig: OpenBSD-funnet kom ut av omtrent 20 000 dollar i modellkjøringer over tusen forsøk, med den suksessfulle kjøringen som kostet under 50 dollar.
Selskapet har sagt at de ikke vil gi ut modellen generelt. I stedet har de sådd Prosjekt Glasswing, et forsvarlig program hvis partnere inkluderer Amazon (AMZN ) Web Services, Apple (AAPL ), Cisco, CrowdStrike (CRWD ), JPMorganChase, Linux Foundation og Palo Alto Networks (PANW ), støttet av 100 millioner dollar i brukskreditt. Konkurrenter bygger mot samme nivå: Microsoft (MSFT ) benchmarket sin egen sikkerhetsmodell mot Mythos da de satte sin første cybermodell inn i Prosjekt Perception i juli 2026.
Hvordan Washington har håndtert modellen
Den føderale responsen hittil har gått gjennom eksportloven snarere enn noen AI-lov. Den 12. juni 2026, ble eksportkontroller ápplikert på Fable 5 og Mythos 5 som forbød bruk av utenlandske nasjonale innenfor eller utenfor landet, etter at tjenestemennene gjennomgikk en Amazon-rapport som beskrev en måte å gå rundt Fable 5s sikkerhetstiltak. Da det ikke var noen måte å verifisere nasjonalitet i sanntid, skrudde Anthropic av begge modellene for alle. Kontrollene ble hevet den 30. juni 2026 en gang selskapet hadde trent en ny klassifiserer som målrettede den rapporterte teknikken og Commerce’s Center for AI Standards and Innovation testet resultatet. Løsningen medfører en kostnad for forsvarere: mer harmløs kodning og feilsøking forespørsler blir blokkert.
En mer varig struktur ankom uker tidligere. En 6. juni 2026 executive order om avansert AI og sikkerhet satte tre deler av maskineri i bevegelse:
- En regjering-industri clearinghouse, ledet av Treasury med National Cyber Director, National Security Agency og US cybersecurity agency, for å dekonflikt vulnerability scanning, validere hva som dukker opp og prioritere patch distribusjon.
- En klassifisert benchmark-prosess, med terskelbeslutningen hvilende på NSA-direktøren, for å bestemme hvilke modeller teller som “dekket frontier-modeller”, pluss en frivillig rute for utviklere å gi regjeringen opptil 30 dagers forhåndsaksess. Ordren utelukker uttrykkelig noen lisensierings- eller forhåndsgodkjenningskrav, en linje laboratorier har presset for som OpenAI presser White House til å akselerere frontier-modellgjennomganger.
- En instruksjon til justisministeren om å prioritere saker under eksisterende datamaskin-svindel-, identitetssvindel- og bedragerilover når AI, inkludert AI-agenter, brukes til å bryte inn i systemer.
Det siste punktet er FBIs oppdrag. Byrået leverer undersøkelsene som politikken omgjør til saker, og det fungerer på samme måte som Washington har testet på modelltilgang, fra eksportkontroller på Anthropics modeller til trusselen om å svartliste Kinas Moonshot over destillasjon.
Inni byråets egen AI-bruk
Hemmen beskrev også FBI som en AI-kjøper, og sa at ansatte bruker teknologien til å triage offentlige rapporter om kriminelle anklager, støtte rettslig godkjente offensiv operasjoner og gjennomføre forskning, med menneskelig gjennomgang av utdataene.
Justisdepartementets 2025 AI-brukssak-inventar lister 315 poster over hele departementet, en økning på 30,7% fra året før. FBI står for omtrent 50 av dem, mer enn dobbelt sin 2024-telling, med omtrent 27 kategorisert som lovens håndheving og flere nye prosjekter som genererer etterforskningsledetråder fra foreslåtte ansiktslikheter. Under en 2025 White House-budsjett-memo, hadde byråene til den 3. april 2026 for å dokumentere minimum risikostyringspraksis for høy-impakt AI som allerede er i tjeneste eller stoppe å bruke det. Inventaret viser at FBI har fullført disse stegene for ingen av sine høy-impakt-deployments, alle av hvilke er lovens håndheving bruksområder.
Clearinghouse er under oppbygging, den klassifiserte terskelen som bestemmer hvilke modeller trekker føderal tilsyn sitter med NSA, og prioriteringen av saker er allerede tildelt. Dette er maskineriet som FBIs neste generasjon av innbruddssaker vil gå gjennom.












