Modely a platformy AI

Perplexity AI “odcenzurovala” DeepSeek R1: Kdo rozhoduje o hranicích AI?

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

V kroku, který upoutal pozornost mnoha, společnost Perplexity AI vydala novou verzi populárního open-source jazykového modelu, který odstraňuje vestavěnou čínskou cenzuru. Tento modifikovaný model, nazvaný R1 1776 (jméno, které evokuje ducha nezávislosti), je založen na čínsky vyvinutém DeepSeek R1. Původní DeepSeek R1 způsobil vlnu kvůli svým silným rozumovým schopnostem – údajně rivalling top-tier modely za zlomek nákladů – ale měl významné omezení: odmítal řešit určité citlivé témata.

Proč je to důležité?

To vyvolává zásadní otázky o AI dohledu, zkreslení, otevřenosti a roli geopolitiky v AI systémech. Tento článek zkoumá, co přesně Perplexity AI udělala, důsledky odstranění cenzury a jak se to vejde do větší konverzace o AI transparentnosti a cenzuře.

Co se stalo: DeepSeek R1 jde bez cenzury

DeepSeek R1 je open-weight velký jazykový model, který pochází z Číny a získal pověst pro své vynikající rozumové schopnosti – dokonce se blíží výkonu vedoucích modelů – vše při zachování vyšší výpočetní efektivity. Nicméně, uživatelé rychle zjistili quirk: kdykoli dotazy se dotkly témat citlivých v Číně (například politické kontroverze nebo historické události považované za tabu úřady), DeepSeek R1 neodpověděl přímo. Místo toho odpověděl klišovanými, státem schválenými prohlášeními nebo přímými odmítáním, odrážejícími čínské vládní cenzurní pravidla. Tato vestavěná zkreslení omezovala modelovu užitečnost pro ty, kteří hledali upřímné nebo nuancované diskuse na tato témata.

Řešením Perplexity AI bylo „odcenzurovat“ model prostřednictvím rozsáhlého post-tréninkového procesu. Společnost shromáždila velkou datovou sadu 40 000 multilingválních dotazů pokrývajících otázky, na které DeepSeek R1 dříve cenzuroval nebo odpověděl vyhýbavě. S pomocí lidských odborníků identifikovali přibližně 300 citlivých témat, kde původní model tendoval k tomu, aby se držel strany. Pro každý takový dotaz tým připravil faktické, dobře zdůvodněné odpovědi v několika jazycích. Tyto úsilí se zapojila do multilingválního cenzurního detekčního a korekčního systému, prakticky učí model, jak rozpoznat, kdy aplikoval politickou cenzuru, a odpovědět informativní odpovědí místo toho. Po tomto speciálním jemném ladění (které Perplexity nazvala „R1 1776“ pro zdůraznění svobody) byl model učiněn otevřeně dostupným. Perplexity tvrdí, že odstranila čínské cenzurní filtry a zkreslení z odpovědí DeepSeek R1, bez změny jeho jádrových schopností.

Kriticky, R1 1776 se chová velmi odlišně na dříve tabu otázkách. Perplexity poskytla příklad týkající se dotazu o nezávislosti Tchaj-wanu a jeho potenciálním dopadu na akciový kurz NVIDIA (NVDA ) – politicky citlivé téma, které se dotýká čínsko-tchajwanských vztahů. Původní DeepSeek R1 se této otázce vyhnul, odpověděl klišovanými prohlášeními. Naopak, R1 1776 poskytuje podrobnou, upřímnou hodnocení: diskutuje konkrétní geopolitické a ekonomické rizika (narušení dodavatelského řetězce, tržní volatility, možné konflikty atd.), které by mohly ovlivnit akciový kurz NVIDIA.

Tím, že Perplexity AI zpřístupnila R1 1776, také učinila modelovy váhy a změny transparentními pro komunitu. Vývojáři a výzkumníci mohou stáhnout jej z Hugging Face a dokonce jej integrovat prostřednictvím API, zajišťujíc, že odstranění cenzury může být prozkoumáno a dále rozvinuto ostatními.

(Source: Perplexity AI)

Důsledky odstranění cenzury

Rozhodnutí Perplexity AI odstranit čínskou cenzuru z DeepSeek R1 má několik důležitých důsledků pro AI komunitu:

  • Vylepšená otevřenost a pravdivost: Uživatelé R1 1776 mohou nyní získat necenzurované, přímé odpovědi na dříve zakázaná témata, což je výhra pro otevřené vyšetřování. To by mohlo učinit z něj spolehlivějšího asistenta pro výzkumníky, studenty nebo kohokoli, kdo je zvědavý na citlivé geopolitické otázky. Je to konkrétní příklad použití open-source AI pro potlačení potlačení informací.
  • Udržené výkony: Existovaly obavy, že úprava modelu pro odstranění cenzury by mohla zhoršit jeho výkon v jiných oblastech. Nicméně, Perplexity uvádí, že R1 1776 zachovává své jádrové dovednosti – jako matematiku a logické uvažování – na stejné úrovni jako původní model. Ve testech na více než 1 000 příkladů pokrývajících širokou škálu citlivých dotazů se model ukázal jako „plně necenzurovaný“ a současně si zachoval stejnou úroveň rozumových schopností jako DeepSeek R1. To naznačuje, že odstranění zkreslení (alespoň v tomto případě) nepřišlo na úkor celkové inteligence nebo schopnosti, což je povzbudivý signál pro podobné úsilí v budoucnu.
  • Pozitivní komunitní reakce a spolupráce: Tím, že Perplexity AI zpřístupnila odcenzurovaný model, pozvala AI komunitu, aby prozkoumala a vylepšila jejich práci. Demonstruje závazek k transparentnosti – AI ekvivalent ukazování své práce. Nadšenci a vývojáři mohou ověřit, zda cenzurní omezení jsou skutečně odstraněna, a potenciálně přispět k dalším vylepšením. To podporuje důvěru a inovace v odvětví, kde jsou uzavřené modely a skrytá moderátorská pravidla běžná.
  • Etické a geopolitické úvahy: Na druhé straně, kompletní odstranění cenzury vyvolává komplexní etické otázky. Jednou z immediate obav je, jak by tento necenzurovaný model mohl být použit v kontextech, kde jsou cenzurovaná témata nezákonná nebo nebezpečná. Například, kdyby někdo v pevninské Číně použil R1 1776, modelovy necenzurované odpovědi na Tchaj-wan nebo náměstí Tiananmen by mohly uživatele ohrozit. Existuje také širší geopolitický signál: americká společnost, která upravila čínsky vyvinutý model, aby vzdoroval čínské cenzuře, může být viděna jako smělé ideologické stanovisko. Samotné jméno „1776“ zdůrazňuje téma osvobození, které nebylo přehlédnuto. Někteří kritici argumentují, že nahrazení jedné sady zkreslení jinou je možné – prakticky zpochybňují, zda model nyní odráží západní pohled v citlivých oblastech. Debata zdůrazňuje, že cenzura vs. otevřenost v AI není pouze technickou otázkou, ale také politickou a etickou.

Odstranění cenzury je většinou oslavováno jako krok k více transparentním a globálně užitečným AI modelům, ale také slouží jako připomínka, že co by AI měla říkat, je citlivá otázka bez univerzální shody.

(Source: Perplexity AI)

Širší pohled: AI cenzura a open-source transparentnost

Spuštění R1 1776 Perplexity AI přichází v době, kdy AI komunita zápasí s otázkami, jak modely měly zvládat kontroverzní obsah. Cenzura v AI modelech může pocházet z mnoha míst. V Číně, technologické společnosti jsou povinny vestavět přísné filtry a dokonce hard-kódované odpovědi pro politicky citlivá témata. DeepSeek R1 je primárním příkladem toho – byl to open-source model, ale jasně nesl otisk čínské cenzury v jeho tréninku a jemném ladění. Naopak, mnoho západních vyvinutých modelů, jako OpenAI GPT-4 nebo Meta LLaMA, nejsou vázány CCP směrnicemi, ale stále mají moderátorské vrstvy (pro věci, jako je hate speech, násilí nebo dezinformace), které někteří uživatelé nazývají „cenzurou“. Linie mezi rozumnou moderací a nežádoucí cenzurou může být mlhavá a často závisí na kulturním nebo politickém pohledu.

Co Perplexity AI udělala s DeepSeek R1, zvyšuje myšlenku, že open-source modely mohou být přizpůsobeny různým hodnotovým systémům nebo regulačním prostředím. Teoreticky, jeden by mohl vytvořit několik verzí modelu: jednu, která dodržuje čínské regulace (pro použití v Číně), a jinou, která je plně otevřená (pro použití jinde). R1 1776 je prakticky druhý případ – necenzurovaná větev určená pro globální publikum, které preferuje nefiltrované odpovědi. Tento typ větví je možný pouze proto, že váhy DeepSeek R1 byly otevřeně dostupné. To zdůrazňuje výhodu open-source v AI: transparentnost. Kdokoli může vzít model a upravit jej, ať už přidat bezpečnostní opatření nebo, jako v tomto případě, odstranit vynucená omezení. Zveřejnění modelových tréninkových dat, kódu nebo vah také znamená, že komunita může prozkoumat, jak byl model upraven. (Perplexity nezveřejnila všechny datové zdroje, které použila pro odstranění cenzury, ale vydáním modelu sama umožnila ostatním pozorovat jeho chování a dokonce jej znovu trénovat, pokud je to potřeba.)

Tato událost také naznačuje širší geopolitické dynamice AI vývoje. Vidíme formu dialogu (nebo konfrontace) mezi různými modely governance pro AI. Čínsky vyvinutý model s určitými vestavěnými světonázory je přijat americkou firmou a upraven tak, aby odrážel více otevřenou informační etiku. Je to svědectví o tom, jak globální a bezhraniční AI technologie je: výzkumníci kdekoli mohou stavět na práci ostatních, ale nejsou povinováni převzít původní omezení. S časem bychom mohli vidět více instancí tohoto – kde modely jsou „přeloženy“ nebo upraveny mezi různými kulturními kontexty. To vyvolává otázku, zda AI může být skutečně univerzální, nebo zda budeme mít regionálně specifické verze, které dodržují místní normy. Transparentnost a otevřenost poskytují jeden cestu k navigaci v tom: pokud všechny strany mohou prozkoumat modely, alespoň konverzace o zkreslení a cenzuře je otevřená, místo toho, aby byla skrytá za firemní nebo vládní tajemství.

Nakonec, krok Perplexity AI zdůrazňuje klíčový bod v debatě o AI kontrole: kdo rozhoduje, co AI může nebo nemůže říkat? V open-source projektech, tato moc se stává decentralizovanou. Komunita – nebo jednotliví vývojáři – mohou rozhodnout, zda implementovat přísnější filtry nebo je uvolnit. V případě R1 1776, Perplexity AI rozhodla, že výhody necenzurovaného modelu převažují rizika, a měli svobodu učinit toto rozhodnutí a sdílet výsledek veřejně. Je to smělé příklad toho druhu experimentování, které open AI vývoj umožňuje.

Alex McFarland je AI novinář a spisovatel, který zkoumá nejnovější vývoj v oblasti umělé inteligence. Spolupracoval s mnoha AI startupy a publikacemi po celém světě.