Holdning

Regeringen har lige bevist, at dit Frontier-model er lejet

mm
Føj Unite.AI til dine foretrukne kilder på Google

Den 12. juni 2026, modtog Anthropic en eksportkontrol-direktiv, og det mest kapable model, som virksomheden nogensinde havde udskibet, gik mørkt. Fable 5 og Mythos 5 var væk, ikke begrænset, ikke geofence, væk, for alle kunder det havde.

Ordren var smallere end udfaldet. Med henvisning til nationale sikkerhedsmyndigheder, sagde regeringen til Anthropic, at de skulle afbryde adgangen til begge modeller for enhver udenlandsk statsborger, både inde og udenfor USA, ned til sine egne udenlandske ansatte.

Anthropic siger, at den samlede effekt efterlod det ingen mulighed for at være i overensstemmelse med kravene, uden at deaktiverer modellerne for alle, så det er, hvad de gjorde. Hver anden Claude-model forblev aktiv. Fable og Mythos gik til nul.

Tre dage tidligere havde virksomheden lanceret Fable 5 som det stærkeste model, det nogensinde havde udskibet til offentligheden, staten af kunsten på næsten alle benchmark, det offentliggjorde. Jeg læste lanceringsmeddelelsen som det øjeblik, frontier AI blev en målelig utility, du tænder på token.

Mythos 5 er det samme underliggende model med de cybersecurity-sikkerhedsforanstaltninger, der er fjernet, og overdraget til godkendte forsvarere. Hele budskabet var Mythos-klassen kapacitet gjort sikkert nok til almindelig udgivelse. Det varede omkring 72 timer, før regeringen tog det af hylden igen.

En snæver fund, et blåt instrument

Brevet selv, ifølge Anthropics egen beretning, gav ingen specifikke nationale sikkerhedsdetaljer. Anthropics forståelse er, at regeringen mener, at nogen har fundet en måde at omgå Fable 5’s sikkerhedsforanstaltninger på, viste embedsmænd en demonstration, og det var nok.

Virksomheden siger, at den gennemgik teknikken og hvad det faktisk afslørede, var en lille mængde allerede kendte, mindre sårbarheder, den type offentlige modeller, der dukker op uden nogen omgåelse overhovedet. Den specifikke udnyttelse, det blev vist, bestod i at bede modellen om at læse en kodebase og rette software-fejl i den.

Anthropic siger, at den samme kapacitet er tilgængelig fra andre frontier-modeller, herunder OpenAI’s GPT-5.5. Så modellen blev trukket tilbage for noget, dens konkurrenter stadig udskiber, på styrken af beviser, virksomheden siger, blev leveret mundtligt.

Anthropic adlyder og argumenterer på samme tid. Dets stilling er blåt: Tilbagekaldelse af en model, der er udskibet til hundredvis af millioner mennesker, over en snæver, ikke-universal jailbreak, ville, hvis det blev anvendt på tværs af brættet, i virkeligheden standse alle nye model-udskibninger for hver frontier-laboratorium.

Virksomheden har sagt offentligt, at regeringen skal kunne blokere virkelig usikre udskibninger, men gennem en proces, der er gennemsigtig, retfærdig og baseret på tekniske kendsgerninger. Ifølge dem er en fredag-aften-brev med en mundtlig begrundelse ikke den proces.

Der er en baggrund, der er værd at nævne omhyggeligt, fordi det meste af det er urigtig rapportering snarere end noget, der er på plads. Udløseren er blevet knyttet til en sikkerhedsfinding, en stor cloud-udbyder rejste med embedsmænd, og til bekymringer om kinesisk adgang, som Anthropic siger, aldrig blev rejst i samtalerne, det faktisk havde. Behandle det som det rygte, det i øjeblikket er. De på plads fakta bærer historien på deres egen.

Den del, der betyder noget, hvis du bygger på dette

Fjern politik og her er, hvad en operatør er tilbage med. Det eneste mest kapable værktøj, der var til rådighed, forsvandt over natten, fjernet af en part, der hverken er dig eller din leverandør, på en tidsplan, du ikke havde noget indsigt i og ingen stemme i.

Dette er den stille risiko, der sidder inde i hver “Claude kan nu gøre X”-meddelelse, og det er den, ingen vil sidde med ugen efter en lancering. Den gevinst, du får fra en frontier-model, er reel, og det er den samme gevinst, nogen ovenfor holder over din adgang til det.

Reaktionen har været skarp nok til, at samtalen er sprunget i skala, til om mellemmagter skal bygge deres egne frontier-modeller snarere end at afhænge af nogen andens. Nationer trækker den konklusion. Operatører skal trække den mindre version af det.

Så du bygger, som om modellen er lånt, fordi den er. Hold en reserve forbundet og faktisk testet, ikke en linje i en kørebog, du aldrig har kørt. Lad ikke den ene uerstattelige trin i din pipeline være på den ene model, der kan forsvinde.

Ej de dele, der er virkelig dine: dine prompts, din kontekst, dine data, systemet, der orkestrerer alt det, fordi det er de dele, ingen direktiv kan slukke.

Den skarpeste ironi er, at Anthropic gik ind i dette delvist ved at være det mest åbne laboratorium i rummet. Det sagde højt, at perfekt jailbreak-resistance ikke er mulig for nogen, offentliggjorde den begrænsning, og byggede sin forsvar-i-dybde-holdning og 30-dages data-tilbagehold på at håndtere problemet snarere end at prætende, det væk.

Ærligheden blev papirsporet. Det er sin egen lektion om, hvad der belønnes lige nu. Men for alle, der kører rigtigt arbejde på disse modeller, er take-away’en enklere.

Ej den del, der er din. Motoren var altid lånt, og ejeren ændrede låsen.

Alex McFarland er en AI-journalist og forfatter, der udforsker de seneste udviklinger inden for kunstig intelligens. Han har samarbejdet med talrige AI-startups og publikationer verden over.