Názor

Vláda právě prokázala, že váš model Frontier je pronajatý

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Dne 12. června 2026 dorazil do Anthropicu direktiv pro kontrolu exportu a nejvýkonnější model, který společnost dosud vydala, byl odstaven. Fable 5 a Mythos 5 byly pryč, nebyly omezeny, nebyly geograficky omezeny, byly pryč pro každého zákazníka.

Rozhodnutí bylo užší než výsledek. S odvoláním na autority národní bezpečnosti vláda nařídila Anthropicu odstavit přístup k oběma modelům pro každého cizince, uvnitř i vně Spojených států, až po své vlastní cizince zaměstnance.

Anthropic tvrdí, že čistý efekt jej nechal bez možnosti dodržet předpis jinak, než odstavit modely pro každého, a tak to udělal. Každý jiný model Claude zůstal funkční. Fable a Mythos šly na nulu.

Tři dny předtím společnost spustila Fable 5 jako nejvýkonnější model, který kdy umístila do rukou veřejnosti, špičkový na téměř všech zveřejněných benchmarcích. Četl jsem spuštění jako okamžik, kdy frontier AI se stal měřenou utilitou, kterou zapnete podle tokenu.

Mythos 5 je stejný základní model s odstraněnými bezpečnostními opatřeními, předaný pouze prověřeným obráncům. Celá nabídka spočívala v tom, že Mythos-class schopnosti byly dostatečně bezpečné pro obecné vydání. Vydržela zhruba 72 hodin, než ji vláda stáhla z regálu.

Úzké zjištění, hrubý nástroj

Dopis sám o sobě, podle vlastních slov Anthropicu, neobsahoval žádné konkrétní národní bezpečnostní detaily. Pochopení Anthropicu je, že vláda věří, že někdo našel způsob, jak obejít bezpečnostní opatření Fable 5, ukázal úředníkům demonstraci, a to stačilo.

Společnost tvrdí, že přezkoumala techniku a co se vlastně ukázalo, byla malá část již známých, menších zranitelností, druh, který se vyskytuje u jiných veřejných modelů bez jakýchkoli obchvatů. Konkrétní exploit, který byl ukázán, spočíval v tom, že se modelu řeklo, aby přečetl kód a opravil software chyby v něm.

Anthropic tvrdí, že stejná schopnost je k dispozici z jiných frontier modelů, včetně OpenAI GPT-5.5. Takže model byl stažen pro něco, co jeho konkurenti stále dodávají, na základě důkazů, které společnost tvrdí, že byly doručeny ústně.

Anthropic dodržuje a současně argumentuje. Jeho postoj je přímý: stažení modelu nasazeného pro stovky milionů lidí kvůli jedné úzké, neuniverzální jailbreak by, kdyby se aplikovalo obecně, fakticky zastavilo všechny nové nasazení modelů pro každou frontier laboratoř.

Společnost řekla veřejně, že vláda by měla být schopna blokovat skutečně nebezpečná nasazení, ale prostřednictvím procesu, který je transparentní, spravedlivý a založený na technických faktech. Podle nich není páteční dopis s ústním zdůvodněním takový proces.

Existuje pozadí, které stojí za to pečlivě uvést, protože většina z něj je neověřené zprávy spíše než cokoliv na záznamu. Spouštěč byl spojen se zabezpečením, které velký cloudový poskytovatel raised s úředníky, a s obavami o čínský přístup, o kterém Anthropic tvrdí, že nebyly nikdy zvednuty v rozhovorech, které skutečně měli. Zacházejte s tím jako s pomluvou, kterou目前 je. Záznamy na záznamu nesou příběh na svých vlastních základech.

Ta část, která záleží, pokud na tom stavíte

Odeberte politiku a zde je to, co operátor drží. Nejvýkonnější nástroj, který je k dispozici, zmizel přes noc, odstraněn stranou, která není ani vy, ani váš dodavatel, na časovém plánu, do kterého jste neměli žádný vhled a neměli jste žádný hlas.

Toto je tiché riziko, které sedí uvnitř každého oznámení “Claude může teď udělat X”, a je to to, se kterým nikdo nechce sedět týden po spuštění. Přínos, který získáte z frontier modelu, je reálný, a je to stejný přínos, který někdo výše drží nad vaším přístupem k němu.

Reakce byla dostatečně ostrá, aby skokovala konverzaci, zda střední mocnosti by měly postavit své vlastní frontier modely místo toho, aby závisely na někom jiném. Národy táhnou ten menší závěr. Operátoři by měli táhnout menší verzi.

Takže stavíte, jako by model byl vypůjčený, protože je. Udržujte záložní napájení a skutečně otestované, ne pouze řádek v runbooku, který jste nikdy neběhali. Nedejte jeden nenahraditelný krok vaší pipeline na jeden model, který může zmizet.

Vlastněte části, které jsou skutečně vašimi: vaše podněty, váš kontext, vaše data, systém, který orchestruje vše, protože ty části nemůže žádný direktiv vypnout.

Nejostřejší ironie je, že Anthropic vstoupil do toho částečně tím, že byl nejupřímnějším laboratořím v místnosti. Řekl nahlas, že dokonalá odolnost proti jailbreaku není možná pro nikoho, publikoval tuto omezení a postavil svou obranu v hloubce a 30denní retenci dat kolem řízení problému místo toho, aby se snažil odstranit.

Upřímnost se stala papírovou stopou. To je jeho vlastní lekce o tom, co je aktuálně odměňováno. Ale pro každého, kdo běží skutečnou práci na těchto modelech, je výstup jednodušší.

Vlastněte část, která je vaší. Motor byl vždy pronajatý, a pronajímatel právě změnil zámky.

Alex McFarland je AI novinář a spisovatel, který zkoumá nejnovější vývoj v oblasti umělé inteligence. Spolupracoval s mnoha AI startupy a publikacemi po celém světě.