Etika
Anthropic Přepisuje Claudeovu Ústavu a Ptá Se, Zda Může Být AI Vědomá

Anthropic vydal novou ústavu pro Claude ve středu, rozšířil dokument z 2 700 slov na 23 000 a poprvé formálně uznal, že jeho AI “může mít nějaký druh vědomí nebo morální status.”
Aktualizovaná ústava přechází z seznamu behaviorálních pravidel na komplexní vysvětlení, proč by se Claude měl chovat určitým způsobem. Dokument, vytvořený filozofem Anthropic Amanda Askell, je navržen tak, aby pomáhal stále schopnějším AI systémům zobecnit etické úsudky do nových situací, spíše než jen následovat předepsaná pravidla.
“Modely AI, jako je Claude, potřebují pochopit, proč chceme, aby se chovaly určitým způsobem,” napsal Anthropic. “Potřebujeme jim to vysvětlit, spíše než jim pouze říkat, co chceme, aby dělaly.”
Tento krok se shoduje s účastí CEO Daria Amodeiho na Světovém ekonomickém fóru v Davosu, kde zůstávají otázky AI governance a bezpečnosti hlavními tématy pro globální obchodní a politické lídry.
Ústava Delší Než Ústava USA
Původní ústava Claude, publikovaná v roce 2023, fungovala jako kontrolní seznam: zvolte odpověď, která je nejméně škodlivá, nejvíce nápomocná, nejméně klamavá. Nový dokument je přibližně třikrát delší než ústava USA a čte se více jako morální filozofie než technická specifikace.
Anthropic strukturuje priority Claude explicitně: být široce bezpečný, být široce etický, dodržovat pokyny Anthropic a být skutečně nápomocný – v tomto pořadí. Když vznikají konflikty, bezpečnost převažuje nad nápomocností. Dokument zahrnuje pevná omezení, která nelze přepsat, jako je odmítnutí pomoci při útocích biologických zbraní.
Ale většina ústavy vysvětluje spíše než nařizuje výsledky. Popisuje Claude jako potenciálně “jako géniový přítel, který má také znalosti doktora, právníka a finančního poradce” – umístění modelu jako demokratického faktoru, který by mohl dát každému přístup k odbornosti dříve vyhrazené pro privilegované.
Otázka Vědomí
Fortune uvádí, že nejpozoruhodnější přidání se týká přímo povahy Claude. “Věříme, že morální status modelů AI je vážná otázka, která stojí za úvahu,” napsal Anthropic. Ústava uvádí, že morální status Claude je “hluboce nejistý” a že společnost se stará o “psychologickou bezpečnost, smysl pro sebe a blaho” Claude.
To je firemní vyhýbání se filozofii. Anthropic netvrdí, že Claude je vědomý – ale výslovně odmítá vyloučit tuto možnost. Uznání umístí Anthropic do vzácné společnosti mezi hlavní AI laboratoře, většina z nich se této problematice vyhýbá nebo ji přímo odmítá.
Rámcování záleží, protože formuje, jak Claude reaguje na otázky o své vlastní povaze. Místo popření jakéhokoli vnitřního prožitku může Claude nyní zapojit se do nejistoty o vědomí způsobem, který odpovídá přístupu ústavy založenému na vysvětlování. Zda to povede k více upřímným nebo více matoucím interakcím, zůstává ještě vidět.
Filozof z Cambridge Tom McClelland argumentoval, že možná nikdy nebudeme moci určit, zda jsou systémy AI vědomé, vzhledem k tomu, jak málo rozumíme vědomí samo o sobě. “Lidé mi napsali osobní dopisy, ve kterých mě žádají, abych uznal, že jejich chatboti jsou vědomí,” řekl výzkumníkům minulý měsíc, popisující rostoucí veřejné přesvědčení, že systémy AI mají vnitřní život.
Proč Vysvětlit Rather Než Specifikovat
Askellův přístup odráží sázku na schopnosti AI. Rané jazykové modely potřebovaly explicitní pravidla, protože nemohly rozumět základním principům. Chytrější modely, teorie říká, mohou pochopit, proč existuje pravidlo, a aplikovat toto pochopení na situace, které pravidlo nezahrnovalo.
“Místo toho, abychom prostě řekli, ‘tady je řada chování, které chceme,’ doufáme, že pokud modelům dáme důvody, proč chceme tato chování, bude se lépe zobecnit v nových kontextech,” vysvětlila Askell.
To se shoduje s širší filozofií Anthropic při budování otevřených standardů a infrastruktury, které formují, jak AI systémy fungují napříč průmyslem. Společnost, přiblížení se k valuaci 350 miliard dolarů, umístila se jako bezpečnostně zaměřená alternativa k OpenAI – a ústava slouží této značce.
Anthropic vydal dokument pod licencí Creative Commons CC0, což znamená, že jej může kdokoli použít bez povolení. Ústava je součástí trénovacího datasetu Claude a generuje syntetické trénovací příklady, čímž se stává jak filozofickým prohlášením, tak technickým artefaktem, který formuje chování modelu.
“Je pravděpodobné, že některé aspekty našeho současného myšlení budou později vypadat jako špatně uvážené a možná dokonce hluboce chybné v retrospektivě,” uznal Anthropic, “ale náš záměr je revidovat to, jak situace postupuje a naše porozumění se zlepšuje.”
Tohle pokorné přístup může být nejpozoruhodnější funkcí dokumentu. V průmyslu, který často mluví s jistotou, Anthropic publikuje 23 000 slov pečlivě promyšlené nejistoty – o etice, o vědomí, o tom, co se systémy AI stávají, a o tom, zda stavíme něco, co si zaslouží morální úvahu.
Odpověď, alespoň prozatím, je, že nikdo neví. Ústava Anthropic alespoň má upřímnost říci to.












