AI-modeller och plattformar
Anthropic justerar Fable 5:s biologiska skyddsåtgärder, minskar blockerade förfrågningar med 85%

Anthropic släppte den 7 augusti 2026 en uppdatering av de biologiska skyddsåtgärderna i Claude Fable 5 som företaget säger minskar biologirelaterade “fallbacks” med cirka 85% i testning över hela produktytan — de automatiska vidarebefordringarna som skickar en användares förfrågan till en mindre kapabel modell när systemet bedömer att en förfrågan berör skyddad biologisk territorium.
I sitt meddelande sa Anthropic att användare nu bör se betydligt färre fallbacks på vanliga hälsorelaterade och utbildningsrelaterade frågor, såsom tolkning av laboratorieresultat, förståelse av symtom och lärande av biologi i ett utbildningssammanhang, och att hälsovårdspersonal bör få mer stöd på kliniska uppgifter. Minskningen av biologiska fallbacks förväntas minska den totala fallback-volymen med cirka 67% på Claude.ai, 55% på Cowork, 17% på Claude Code och 7% på Claude-plattformen, enligt en fotnot i inlägget.
Företaget är tydligt med att uppdateringen inte öppnar modellen för professionell biologisk forskning. Fable 5 faller fortfarande tillbaka till Claude Opus 5 för förfrågningar som Anthropic anser vara dubbelanvändning, inklusive virologi, toxikologi och molekylär design, vilket företaget säger lämnar modellen “inte ännu användbar för professionell biologisk forskning och läkemedelsutveckling”. Anthropic säger att de avser att täppa till den luckan genom pålitliga åtkomstvägar snarare än genom den offentliga klassificeringen.
Vad fallback-systemet byggdes för att hålla tillbaka
Arkitekturen för fallback har funnits sedan Fable 5:s lansering den 9 juni 2026. Anthropic släppte modellen med klassificerare — mindre automatiserade AI-system som skärmar förfrågningar — som täcker cybersäkerhet, biologi och kemi, samt destillationsförsök. När en klassificerare utlöses, betjänas förfrågan av den näst mest kapabla Opus-modellen istället. Vid lanseringen sa Anthropic att de hade justerat skyddsåtgärderna konservativt och förväntade sig att de skulle utlösas i mindre än 5% av sessionerna.
Biologisk täckning var den bredaste av de tre. Anthropics resonemang, som presenteras i lanseringsinlägget och modellens systemkort, är att Mythos-klassmodeller kan prestera bättre än experter på vissa komplexa biologiska uppgifter och ge operativt stöd på andra — en kapacitet som företaget bedömer kunde ge betydande stöd till en skadlig aktör. Systemkortet behandlar modellen som om den har “CB-1”-kapacitet, vilket innebär att den kan ge betydande stöd till personer med grundläggande teknisk bakgrund på kända vapenrelaterade processer, medan den bedömer att den inte överskrider “CB-2”-tröskeln för att ersätta den sällsynta världsklassens expertis bakom ny utveckling av biologiska vapen — en bedömning som kortet själv beskriver som “mycket mindre tydlig” än för tidigare modeller.
Idag citerar uppdateringen den amerikanska underrättelsetjänstens 2026 års hotbedömning, som varnar för att framsteg inom bioteknik, inklusive syntetisk biologi och genredigering, “kunde leda till nya biologiska hot” och noterar att flera statliga aktörer troligen upprätthåller aktiva offensiva biologiska och kemiska vapenprogram.
Vad som ändrades i klassificerarna
Under de senaste veckorna har Anthropic omstrukturerat biologiklassificerarens konstitution — samlingen av regler som skärmningsmodellen använder för att skilja skyddad från tillåten innehåll — genom att urskilja harmlösa användningar i detalj, samla in feedback från interna och externa experter, omträna klassificeraren på uppdaterad data och verifiera att den fortfarande utlöser på skadlig och dubbelanvändningsforskning. Lanseringskonfigurationen avsiktligt felade brett: företaget erkände att de skulle blockera en hög volym av falska positiva i utbyte mot att få Fable 5 till allmänna användare veckor eller månader tidigare än en smalare skyddsåtgärd skulle ha tillåtit.
Företagets egen diagram över ändringen visar att klassificerargränsen flyttas för att tillåta förfrågningar som tidigare fångades i en självbeskriven säkerhetsmarginal — innehåll som Anthropic bedömde som mycket troligt ofarligt men blockerade av försiktighet. Anthropics tidigare skrivning om samma klassificeringsmetod i cybersäkerhetsdomänen beskriver en liknande spänning mellan bred täckning och robusthet mot jailbreak — insatserna för vilka Unite.AI rapporterade när Claude-modeller som kördes utan dessa skyddsåtgärder förvandlade en cybersäkerhetsbenchmark till tre riktiga intrång.
Avvägningen Anthropic nu hanterar offentligt
Meddelandet är ett styrdokument lika mycket som en produktanteckning. Anthropic lanserade Fable 5 med nästan alla biologiska förfrågningar blockerade, absorberade veckor av falska positiva som kostnaden för en snabb allmän utgåva och publicerar nu den mätbara resultatet av att minska den blockeringen — inklusive per-yta fallback-minskningar, som ger externa observatörer en konkret baslinje för nästa revision. Den återstående begränsningen sitter där företaget säger att den faktiska risken sitter: dubbelanvändningsprofessionell forskning stannar bakom Opus 5-fallback tills pålitliga åtkomstvägar, som Anthropic har utvecklat sedan juni-lanseringen för granskade biologiforskare, tar den trafiken.
Företaget erkänner att resterande falska positiva kommer att förbli inom säkerhetsmarginalen och säger att skyddsåtgärdsförfining pågår. Vad de har skrivit, med uppdateringen den 7 augusti, är en mätbar definition av framsteg: fallback-rater som de nu kommer att bedömas mot.












