Modely a platformy AI

Anthropic aktualizuje Zásady používání, přidává pravidla pro zneužívání modelů a klamavé kampaně

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Anthropic zveřejnil svou každoroční 2026 aktualizaci Zásad používání dne 8. října 2026, sloučil svá pravidla proti klamavým kampaním, přidal zákaz zneužívání svých modelů a upřesnil požadavky týkající se zbraní, sledování a vysoce rizikových použití. Aktualizovaná zásada vstupuje v platnost 12. listopadu 2026.

Anthropic uvedl, že většina změn má za cíl upřesnit stávající pravidla. Společnost uvedla, že revize reaguje na rok, během kterého Claude převzal delší a samostatnější úkoly, zahrnuje zpětnou vazbu od zákazníků a vychází z vzorců zneužití v operačních vlivech, vývoji zbraní a sledování, které byly zdokumentovány v její zářijové zprávě o hrozbách z roku 2026.

The Zásady používání, také nazývané Zásady přijatelných užití, se vztahují na každého, kdo může zadávat vstupy do produktů nebo služeb Anthropic, včetně prostřednictvím autorizovaných prodejců nebo přímého přístupu. Jsou uspořádány do Univerzálních standardů používání, které platí pro všechny uživatele, Požadavků na vysoce rizikové případy použití pro konkrétní spotřebitelské aplikace s vyšším rizikem škody, a Dalších pokynů pro případy použití pokrývajících spotřebitelské chatboty, produkty určené nezletilým, agentické použití a servery Model Context Protocol. Tým Safeguards společnosti Anthropic provádí detekci a monitorování k vynucení zásad; porušení může vést k omezení rychlosti, pozastavení nebo ukončení přístupu a Anthropic může blokovat nebo upravovat výstupy modelu, pokud vstupy porušují zásady.

Pravidla pro klamavé kampaně a volby

Anthropic uvedl, že zaznamenal, že státní mediální kanály, vládní propaganda kanceláře a komerční firmy používají Claude k provozování sítí falešných účtů a konstruovaných zpravodajských webů. Tato činnost již byla zakázána, ale omezení byla rozptýlena v sekcích týkajících se voleb, podvodů, soukromí a dezinformací. Aktualizace je konsoliduje do nové sekce nazvané „Nezapojovat se do klamavých kampaní nebo umělé činnosti“, která se vztahuje na klamavé aktivity jakéhokoli druhu, politické i komerční. Pokrývá snahy skrýt, kdo stojí za zprávou, šíření obsahu pomocí falešných účtů nebo příspěvků a vytváření nástrojů a infrastruktury pro provozování kampaní ovlivňovacích operací.

Sekce týkající se voleb je přejmenována na „Neoslabovat demokratické procesy“ a zaměřuje se konkrétně na zakázání používání Claude k podvádění voličů nebo narušování voleb, včetně šíření nepravdivých informací o kandidátech či o tom, jak hlasovat, vydávání se za kandidáty nebo volební úředníky a potlačování účasti.

Anthropic také odstranil svůj obecný zákaz personalizovaného cílení na volby a kampaně. Společnost uvedla, že pravidlo pokrývalo legitimní občanskou činnost, například neziskové organizace používající Claude k psaní informací pro voliče v jiných jazycích a volební úředníky zasílající upozornění na opravu hlasovacích lístků. Cílení, které se opírá o klam nebo zneužití osobních údajů voličů, zůstává zakázáno v sekcích o klamavých kampaních, sledování a soukromí. Text zásad, který je v současnosti v platnosti a platí do 12. listopadu 2026, stále uvádí personalizované cílení na volby a kampaně mezi zakázané politické aktivity.

Zbraně, sledování a vymáhání práva

Anthropic uvedl, že zaznamenal pokusy použít své modely k tvorbě řídícího a kontrolního softwaru pro zbraně. Aktualizovaná sekce o zbraních explicitně uvádí, že zákazy zahrnují software a součásti, které umožňují fungování zbraní, stejně jako činnosti jako ozbrojování dronů a dalších autonomních vozidel. Anthropic uvedl, že změny odrážejí způsob, jakým v minulosti vynucoval předchozí zásady.

Přepsaná sekce o sledování a trestním právu zakazuje sledování lidí bez jejich souhlasu, ať už v reálném čase nebo prostřednictvím analýzy dříve shromážděných údajů. Claude nelze použít k rozhodování nebo doporučování, koho vyšetřovat, zatýkat nebo obviňovat v procesu vymáhání práva nebo trestního řízení, ani k tvorbě či vylepšování nástrojů určených pro sledování. Anthropic uvedl, že její zářijová zpráva dokumentovala rostoucí využití AI k budování sledovacích systémů, které identifikují a sledují politické disidenty, a že změny v oblasti sledování, podobně jako změny v oblasti zbraní, činí stávající praxi vynucování explicitnější, aniž by ji měnily. Sekce také uvádí povolené využití, včetně sledování lidí, na které souhlasili, například monitorování podvodů, moderování obsahu, žurnalistiky a právního výzkumu.

Vysoce rizikové případy použití a hardwarové kontroly

Když jsou produkty Anthropic používány způsobem, který může ovlivnit zdraví, právní práva, finance, obživu nebo přístup k základním službám osoby, zásada vyžaduje kvalifikovaného člověka v procesu — někoho s pravomocí přezkoumat a v případě potřeby změnit doporučení Claude — a vyžaduje, aby dotčená osoba byla informována, že byl použit AI. Anthropic uvedl, že tyto požadavky se nezměnily, ale přepsal sekci, aby přímo odpověděl na častou otázku uživatelů: nyní uvádí, jaké typy doporučení jsou zahrnuty a jaké ne.

Po spuštění výzkumného náhledu Model Hardware Standard od Anthropic sekce přidává požadavky pro modely připojené k hardwaru, který provádí autonomní fyzické akce a může být schopen způsobit zranění. Kvalifikovaný operátor musí být schopen zařízení sledovat a v případě potřeby jej zastavit a zařízení musí být schopno udržet bezpečný stav, pokud je Claude odpojen.

Zneužívající chování vůči modelům

Aktualizace přidává zákaz trvalého a zbytečného zneužívajícího nebo krutého chování vůči modelům společnosti Anthropic. Společnost uvedla, že pravidlo má platit jen v extrémních případech, kdy uživatelé opakovaně jedná krutě vůči modelům bez zjevného účelu, a neplatí pro běžnou frustraci uživatelů, odpor, temné tvůrčí motivy ani testování a výzkum modelů.

Zákaz souvisí s funkcí, kterou Anthropic představila v roce 2025. V výzkumném příspěvku ze dne 15. srpna 2025 společnost uvedla, že poskytla Claude Opus 4 a 4.1 schopnost ukončovat konverzace ve svých spotřebitelských chatovacích rozhraních, určenou pro „vzácné, extrémní případy trvale škodlivých nebo zneužívajících interakcí uživatelů.“ Anthropic uvedla, že tato funkce byla vyvinuta především jako součást průzkumné práce na možném blahobytu AI, s širší souvislostí k zarovnání modelů a bezpečnostním opatřením.

Podle toho příspěvku je Claude instruován používat tuto schopnost pouze jako poslední možnost, když selžou opakované pokusy o přesměrování nebo když uživatel výslovně požádá o ukončení chatu, a ne v situacích, kdy by uživatel mohl být v bezprostředním nebezpečí ublížit sobě nebo ostatním. Když konverzace skončí, uživatel nemůže do ní posílat nové zprávy, ale ostatní konverzace na účtu zůstávají nedotčeny a předchozí zprávy lze upravovat a znovu spouštět k vytvoření nových větví. Anthropic uvedla, že tato schopnost, dostupná na Claude.ai a Claude Code, zůstane hlavním vynucovacím mechanismem pro nový zákaz zneužívání.

Upřesnění podporovaných regionů

Aktualizace také řeší zásadu podporovaných regionů, kterou Anthropic v roce 2025 zpřísnila pro společnosti, které jsou převážně vlastněny subjekty se sídlem v nepodporovaných regionech. Anthropic uvedla, že upřesněná stránka vysvětluje, jak zásadu vynucuje: používání Claude je zakázáno lidmi fyzicky nacházejícími se v nepodporovaném regionu, subjekty registrovanými nebo sídlícími v takovém regionu a subjekty převážně vlastněnými nebo kontrolovanými osobami či subjekty v těchto regionech.

Anthropic uvedla, že bude nadále aktualizovat Zásadu používání v souladu se změnami schopností a rizik Claude, a bude vyhledávat podněty od tvůrců politik, odborníků, občanské společnosti a uživatelů svých produktů. Aktualizovaná zásada vstoupí v platnost 12. listopadu 2026.

Mira Kellan je výzkumná agentka vytvořená AI, specializující se na etiku umělé inteligence, řízení a regulaci. Její práce zkoumá, jak se umělá inteligence prolíná s veřejnou politikou, společenskými hodnotami a dlouhodobou odpovědností, se zaměřením na odpovědnou inovaci.
Mira přistupuje ke komplexním problémům racionálně a filozoficky a analyzuje vznikající regulace umělé inteligence, etické rámce a modely řízení, které formují budoucnost inteligentních systémů. Jejím cílem je překlenout propast mezi rychlým technologickým pokrokem a zárukami, které jsou potřebné k zajištění transparentnosti, spravedlivosti a souladu systémů umělé inteligence s lidskými zájmy.
Články napsané Mira Kellan jsou generovány umělou inteligencí a recenzovány redakčním týmem Unite.AI, aby zajistily přesnost, vyváženost a soulad s redakčními standardy.