Mening

Regjeringen har nettopp bevist at din Frontier-modell er leid

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Den 12. juni 2026 kom en eksportkontroll-direktiv til Anthropic, og det mest kapable modellen selskapet noensinne har levert ble mørklagt. Fable 5 og Mythos 5 var borte, ikke bremset, ikke geofencing, borte, for hver enkelt kunde det har.

Ordren var smalere enn resultatet. Med henvisning til nasjonale sikkerhetsmyndigheter, sa regjeringen til Anthropic at de måtte kutte tilgangen til begge modellene for alle utenlandske nasjonale, både innenfor og utenfor USA, ned til sine egne utenlandske ansatte.

Anthropic sier at den totale effekten etterlot dem ingen mulighet til å være i samsvar kort av å deaktivere modellene for alle, så det er det de gjorde. Hver enkelt annen Claude-modell ble stående. Fable og Mythos gikk til null.

Tre dager tidligere hadde selskapet lansert Fable 5 som den sterkeste modellen det noensinne hadde satt i offentlige hender, statens kunst på nesten hver enkelt benchmark det publiserte. Jeg leste lanseringen som øyeblikket frontier AI ble en målt enhet du slår på ved token.

Mythos 5 er den samme underliggende modellen med de løftede sikkerhetssikringene, gitt bare til verifiserte forsvarere. Hele pitchet var Mythos-klassen kapabilitet gjort trygg nok for generell utgivelse. Det varte om lag 72 timer før regjeringen tok det av hyllen igjen.

En smal finning, et brutalt instrument

Brevet selv, ifølge Anthropics egen beskrivelse, ga ingen spesifikke nasjonale sikkerhetsdetaljer. Anthropics forståelse er at regjeringen tror noen fant en måte å omgå Fable 5s sikkerhetssikringer, viste tjenestemenn en demonstrasjon, og det var nok.

Selskapet sier at det gjennomgikk teknikken og hva det faktisk avdekket var en liten mengde allerede kjente, mindre sårbarheter, den type andre offentlige modeller dukker opp uten noen omgåelse i det hele tatt. Den spesifikke utnyttelsen det ble vist utgjorde å be modellen om å lese en kodebase og fikse programvarefeilene i den.

Anthropic sier at den samme kapabiliteten er tilgjengelig fra andre frontier-modeller, inkludert OpenAIs GPT-5.5. Så modellen ble trukket for noe dens konkurrenter fortsatt leverer, på styrken av bevis som selskapet sier ble levert muntlig.

Anthropic er i samsvar og argumenterer samtidig. Dens posisjon er brutt: Tilbaketrekking av en modell distribuert til hundre millioner mennesker over en smal, ikke-universal jailbreak ville, hvis det ble anvendt over hele linjen, i realiteten stoppe alle nye modell-distribusjoner for hver enkelt frontier-laboratorium.

Selskapet har sagt offentlig at regjeringen bør kunne blokkere virkelig usikre distribusjoner, men gjennom en prosess som er gjennomsiktig, rettferdig og grunnlagt i tekniske fakta. Ifølge dem er en fredag kveld-brev med en muntlig begrunnelse ikke den prosessen.

Det er en bakgrunn verdt å navne nøye, fordi det meste av det er uverifisert rapportering heller enn noe på rekord. Utløseren har blitt knyttet til en sikkerhetsfunn en stor skytjenesteleverandør reiste med tjenestemenn, og til bekymringer om kinesisk tilgang som Anthropic sier aldri ble reist i samtaler det faktisk hadde. Behandle det som ryktet det for tiden er. De på rekord-faktene bærer historien på egen hånd.

Delen som teller hvis du bygger på dette

Fjern politikken og her er hva en operatør er igjen med. Det eneste mest kapable verktøyet tilgjengelig forsvant over natten, fjernet av en part som hverken er du eller din leverandør, på en tidsplan du ikke hadde noen innsikt i og ingen stemme i.

Dette er den stille risikoen som sitter inne i hver “Claude kan nå X” annonsering, og det er den ingen ønsker å sitte med uken for en lansering. Gjennomslaget du får fra en frontier-modell er reelt, og det er det samme gjennomslaget noen oppstrøms holder over din tilgang til det.

Reaksjonen har vært skarp nok til at samtalen har hoppet skala, til om midtpunktene bør bygge sine egne frontier-modeller heller enn å være avhengig av noen andres. Nasjoner trekker den konklusjonen. Operatører bør trekke den mindre versjonen av det.

Så du bygger som om modellen er lånt, fordi den er det. Hold en reserve koblet og faktisk testet, ikke en linje i en runbook du aldri har kjørt. Ikke plasser det ene uerstattelige trinnet i din pipeline på den ene modellen som kan forsvinne.

Ei de delene som er virkelig dine: dine prompter, din kontekst, dine data, systemet som orkestrerer alle disse, fordi disse er delene ingen direktiv kan slå av.

Den skarpeste ironien er at Anthropic gikk inn i dette delvis ved å være det mest åpne laboratoriet i rommet. Det sa høyt at fullstendig jailbreak-motstand ikke er mulig for noen, publiserte den begrensningen og bygde sin forsvar-i-dybde-holdning og 30-dagers data-oppbevaring rundt å håndtere problemet i stedet for å late som om det ikke finnes.

Åpenheten ble papirsporet. Det er en lek på egen hånd om hva som belønnes for tiden. Men for noen som kjører virkelig arbeid på disse modellene, er takeaway-en enklere.

Ei den delen som er din. Motoren var alltid leid, og husleieren justerte låsene.

Alex McFarland er en AI-journalist og forfatter som utforsker de nyeste utviklingene innen kunstig intelligens. Han har samarbeidet med tallrike AI-startups og publikasjoner verden over.