Modely a platformy AI

Už Neděláme AIs Soulad. Už Děláme Soulad Civilizací

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Po mnoho let byla hlavní otázkou v oblasti umělé inteligence (AI), jak sladit modely AI s lidskými hodnotami. Výzkumníci se snažili definovat bezpečnostní pravidla, etické zásady a kontrolní mechanismy, které řídí rozhodnutí AI. Tato práce dosáhla významného pokroku. Ale nyní, když tyto systémy AI rostou stále schopnější a rozšířenější, se začíná měnit zaměření sladění. Co začalo jako výzva sladit jeden model s jedním sadou instrukcí, se nyní stalo mnohem větší výzvou sladit celé civilizace, které tyto systémy používají na globální úrovni. AI již není jen nástroj. Rozvíjí se do prostředí, kde společnosti pracují, komunikují, vyjednávají a soutěží. V důsledku toho se sladění již nezůstává technickým problémem. Stalo se civilizačním problémem. V tomto článku vysvětluji, proč sladění již není jen o modelech a proč musíme začít myslet v termínech civilizací místo strojů. Také diskutuji, jak tato změna ovlivňuje naše odpovědnosti a co to znamená pro globální spolupráci.

Které Hodnoty AI Skutečně Reprezentuje?

Pokud se zeptáte AI na citlivou historickou událost, jeho odpověď závisí na datech, která studoval. Pokud tato data pocházejí převážně z internetu Západu, odpověď bude mít západní předpojatost. Prioritizuje individualismus, otevřenou řeč a demokratické ideály. Tyto hodnoty jsou dobré pro mnoho lidí. Ale nejsou jediné hodnoty na světě.

Uživatel v Singapuru, uživatel v Rijádu a uživatel v San Francisku mají různé definice toho, co je “užitečné” a co je “škodlivé.” V některých kulturách je sociální harmonie důležitější než absolutní svoboda projevu. V jiných je respekt k hierarchii důležitější než narušení.

Když společnost ze Silicon Valley používá “Reinforcement Learning from Human Feedback” (RLHF), najímají lidi, aby ohodnotili odpovědi AI. Ale kdo jsou tito lidé? Jaké jsou jejich víry? Pokud sladíte model s americkými standardy, náhodou budujete americký kulturní export. Budujete digitálního diplomata, který vynucuje pravidla jedné konkrétní civilizace na zbytek světa.

Růst Smyček Zpětné Vazby

Výzva není jen to, že AI odráží víry jedné kultury. Je to, jak tyto víry mohou změnit nás. Moderní systémy AI mají potenciál tvarovat chování jednotlivců, organizací a dokonce i národů. Mohou ovlivnit, jak přemýšlíme, pracujeme, důvěřujeme a soutěžíme. To vytváří smyčky zpětné vazby mezi systémy AI a lidskými společnostmi; trénujeme AI a AI tvaruje, jak přemýšlíme a jednáme. Tyto smyčky se stávají silnějšími, jak se AI stává více všudypřítomným. Abychom viděli, jak tato smyčka funguje, jsou zde dva příklady:

  • Velká nasazení AI mění sociální chování, a sociální chování mění data, která trénují nové systémy. Například algoritmus doporučení může tvarovat, co lidé sledují, čtou a věří. Nástroje produktivity mění, jak týmy spolupracují a jak studenti se učí. Tyto posuny v chování mění datové vzorce ve formě různých zvyklostí sledování, vzorců komunikace na pracovišti nebo stylů psaní. Když tato data proudí do budoucích trénovacích dat, modely upravují své předpoklady a výstupy odpovídajícím způsobem. Chování lidí tvaruje modely, a modely, naopak, tvarují chování lidí.
  • Automatizované rozhodovací nástroje ovlivňují veřejnou politiku, a veřejná politika ovlivňuje budoucí trénování modelů. Například mnoho vlád nyní používá AI, aby navrhnula, kde alokovat zdroje, jako je identifikace, které čtvrti potřebují více podpory zdravotní péče nebo které oblasti mohou vidět vyšší riziko zločinu. Když se politici rozhodnou na základě těchto doporučení, výsledky těchto rozhodnutí se později stávají součástí nových dat. V průběhu času se rozhodnutí politiky tvarovaná AI stávají součástí příští generace modelů AI.

Jakmile uznáte tuto smyčku, stává se jasné, že AI postupně tvaruje a sladění civilizací. V důsledku toho se národy začínají ptát: Jak mohou chránit své hodnoty, zatímco integrují AI do svých společností a institucí?

Vznik Suverénní AI

Tato výzva sladění vyvolala významnou reakci ze strany vlád po celém světě. Národy si uvědomily, že spoléhání se na dovezenou AI je rizikem pro jejich suverenitu. Nemohou si dovolit, aby jejich občané byli vzděláváni, informováni a radeni černou skříňkou, která myslí jako cizinec.

Tato realizace vedla ke vzniku “Suverénní AI.” Francie investuje značně do budování modelů, které mluví francouzsky a rozumí francouzskému zákonu a kultuře. Indie buduje původní modely AI, aby zajistila své kulturní hodnoty. Spojené arabské emiráty a Čína budují modely AI sladěné se svými vlastními národními vize.

Toto je nová zbrojní závod. Je to závod o kontrolu narativu. Civilizace, která nemá svou vlastní AI, nakonec ztratí svou vlastní paměť. Pokud vaše děti položí stroji otázku a stroj odpoví logikou jiné kultury, vaše kultura začíná erodovat. Tato realizace, nicméně, může vést ke vzniku různých digitálních bloků. Můžeme skončit s západní AI, čínskou AI, indickou AI a tak dále. Tyto systémy budou fungovat s jinými fakty a jinými morálními kompasami. Tyto vývojové tendence ukazují, že pokud chceme vytvořit jeden, skutečně sladěný model AI, musíme nejdříve najít způsob, jak sladit civilizace.

Potřebujeme Diplomatickou AI

Tradiční sladění předpokládá, že model lze sladit pečlivým trénováním, promptováním a zábranami. Tento způsob myšlení pochází z technického myšlení raného výzkumu AI bezpečnosti. Ale dokonce i perfektní sladění modelu nemůže vyřešit výzvy sladění civilizací. Sladění nemůže zůstat stabilní, když společnosti táhnou v opačných směrech. Pokud mají země, společnosti a komunity protichůdné cíle, budou tlačit systémy AI, aby odrážely tyto konflikty. Tyto limity ukazují, že sladění není pouze technickým problémem. Je to problém governance, kultury a koordinace. A tyto problémy vyžadují nejen odborníky nebo vývojáře. Zahrnují celé civilizace.

Jak tedy postupujeme? Pokud přijmeme, že univerzální sladění je nemožné, musíme změnit svou strategii. Musíme přestat hledat technické řešení filozofického problému. Musíme začít myslet jako diplomaté. Budeme muset vyvinout protokoly pro “Sladění Civilizací.” Musíme zjistit, jak AI může respektovat víry a hodnoty společnosti bez toho, aby jí vnucovaly víry jiných kultur. Jinými slovy, potřebujeme digitální Organizaci spojených národů pro naše algoritmy.

To vyžaduje transparentnost. V současné době nevíme, jaké hodnoty jsou skryty v hlubokých vrstvách neuronové sítě. Vidíme pouze výstup. Abychom sladili civilizace, musíme být jasnými o “Ústavě” každého modelu. Model by měl být schopen deklarovat svou předpojatost. Měl by být schopen říci: “Jsem trénován na těchto datech, s těmito bezpečnostními pravidly, priorizujícím tyto hodnoty.” Teprve když je předpojatost viditelná, můžeme důvěřovat systému. Uživatel by měl být schopen přepínat mezi perspektivami. Měli byste být schopni položit otázku a vidět, jak “západní” model odpoví ve srovnání s “východním” modelem. To by proměnilo AI v nástroj pro pochopení, spíše než v nástroj pro indoktrinaci.

Závěrečné Shrnutí

Strávili jsme příliš mnoho času starostí o Terminátora. Skutečné riziko není to, že robot nás zničí. Skutečné riziko je to, že robot způsobí, že zapomeneme, kdo jsme. Sladění není kód, který můžeme napsat jednou a zapomenout. Je to stálá jednání s modely AI, abychom je udrželi sladěné s našimi vírami a hodnotami. Je to politický akt. Když vstupujeme do této další fáze věku inteligence, musíme se dívat za obrazovku. Musíme zvažovat, jak AI interpretuje naši historii, naše hranice a naše víry. Budujeme mysl, která nám pomůže řídit svět. Musíme zajistit, aby tyto mysli respektovaly rozdíly mezi civilizacemi.

Dr. Tehseen Zia je docent s trvalým úvazkem na COMSATS University Islamabad, držitel titulu PhD v oblasti AI z Vienna University of Technology, Rakousko. Specializuje se na umělou inteligenci, strojové učení, datové vědy a počítačové vidění, a významně přispěl publikacemi v renomovaných vědeckých časopisech. Dr. Tehseen také vedl různé průmyslové projekty jako hlavní výzkumník a působil jako konzultant pro umělou inteligenci.