AI-mallit ja alustat
Perplexity AI “sensuroi” DeepSeek R1: Kuka päättää tekoälyjen rajoista?
Perplexity AI on julkaissut uuden version suositusta avoimen lähdekoodin kielen mallista, joka poistaa kiinalaisen sensuurin. Tämä muokattu malli, joka on nimetty R1 1776:ksi (nimi, joka herättää itsenäisyyden henkeä), perustuu kiinalaisen DeepSeek R1 -malliin. Alkuperäinen DeepSeek R1 herätti huomiota vahvoilla päättelykyvyillään – se kilpaili huipputason malleja vastaan murto-osalla kustannuksista – mutta se oli rajoitettu: se kieltäytyi käsittelemästä tiettyjä arkaluontoisia aiheita.
Miksi tämä on merkittävää?
Se herättää tärkeitä kysymyksiä tekoälyvalvonnasta, vinouduksesta, avoimuudesta ja geopolitiikan roolista tekoälyjärjestelmissä. Tämä artikkeli tutkii, mitä Perplexity AI teki, mitkä ovat sensuurin poistamisen vaikutukset ja miten se sopii laajempaan keskusteluun tekoälynsäätelystä ja sensuurista.
Mikä tapahtui: DeepSeek R1 menetti sensuurin
DeepSeek R1 on avoimen lähdekoodin suuri kielen malli, joka on peräisin Kiinasta ja saavutti mainetta erinomaisilla päättelykyvyillään – se lähestyi jopa johtavien mallien suorituskykyä – ollessaan samalla laskennallisen tehokkaampi. Käyttäjät huomasivat kuitenkin pian erikoisuuden: kun kysymykset koskivat Kiinassa arkaluontoisia aiheita (esim. poliittisia kiistoja tai historiallisia tapahtumia, joita viranomaiset pitävät tabuna), DeepSeek R1 ei vastannut suoraan. Sen sijaan se vastasi valmiiksi kirjoitettuilla, virallisesti hyväksyttyjen lausumilla tai suoralta kädeltä kieltäytyi vastaamasta, heijastaen kiinalaisten viranomaisten sensuurisääntöjä. Tämä sisäänrakennettu vinous rajoitti mallin hyödyllisyyttä niille, jotka etsivät rehellisiä tai monipuolisia keskusteluja noista aiheista.
Perplexity AI:n ratkaisu oli “desensuroida” malli laajan jälkikoulutusprosessin kautta. Yritys keräsi suuren joukon 40 000 monikielisen kysymyksen aineistoa, joka kattoi kysymyksiä, joita DeepSeek R1 aikaisemmin sensuroi tai vastasi epämääräisesti. Ihmisen asiantuntijoiden avulla he tunnistivat noin 300 arkaluontoista aihetta, joissa alkuperäinen malli taipui puolueen linjalle. Jokaiselle tällaiselle kysymykselle tiimi kokosi tosiasiallisia, hyvin perusteltuja vastauksia useilla kielillä. Nämä ponnistelut syöttivät monikieliseen sensuurin havaitsemis- ja korjausjärjestelmään, joka opetti mallille, miten tunnistaa, kun se soveltaa poliittista sensuuria, ja vastata sijaan tietopohjaisella vastauksella. Jälkikoulutuksen jälkeen (jota Perplexity kutsui lempinimellä “R1 1776” vapauden teeman korostamiseksi) malli julkaistiin avoimesti. Perplexity väittää poistaneensa kiinalaisen sensuurin suodattimet ja vinoukset DeepSeek R1:n vastauksista ilman, että se muutti mallin ydinkykyjä.
Olennaisesti R1 1776 käyttäytyy eri tavoin aiemmin tabuina pidetyillä kysymyksillä. Perplexity esitti esimerkin, jossa kysymys koski Taiwanin itsenäisyyden vaikutusta NVIDIA (NVDA ):n osakekurssiin – poliittisesti arkaluontoista aihetta, joka liittyy Kiinan ja Taiwanin suhteisiin. Alkuperäinen DeepSeek R1 vältti kysymystä ja vastasi puolueen mukaisilla fraseologioilla. Sen sijaan R1 1776 antaa yksityiskohtaisen, avoimen arvion: se käsittelee konkreettisia geopolitiikkaa ja taloudellisia riskejä (toimitusketjun keskeytyksiä, markkinavolatiliteettia, mahdollista konfliktia jne.), jotka voivat vaikuttaa NVIDIA:n osakkeeseen.
Julkaisemalla R1 1776 avoimesti Perplexity on myös tehnyt mallin painot ja muutokset avoimiksi yhteisölle. Kehittäjät ja tutkijat voivat ladata sen Hugging Facen kautta ja jopa integroida sen API:n kautta, varmistaen, että sensuurin poistaminen voidaan tarkastella ja parantaa muilla.

(Lähde: Perplexity AI)
Sensuurin poistamisen vaikutukset
Perplexity AI:n päätös poistaa kiinalainen sensuuri DeepSeek R1:stä kantaa useita tärkeitä vaikutuksia tekoälyyhteisölle:
- Parannettu avoimuus ja totuus: R1 1776:n käyttäjät voivat nyt saada sensuroimattomia, suoria vastauksia aiemmin kielletyille aiheille, mikä on voitto avoimelle tutkimukselle. Tämä voi tehdä siitä luotettavamman avustajan tutkijoille, opiskelijoille tai kenelle tahansa, joka on utelias arkaluontoisista geopolitiikkaa koskevista kysymyksistä. Se on konkreettinen esimerkki avoimen lähdekoodin tekoälyn käytöstä tietojen salaamisen vastaisena.
- Säilytetty suorituskyky: Oli huolta siitä, että mallin muokkaaminen sensuurin poistamiseksi heikentäisi sen suorituskykyä muilla aloilla. Perplexity kuitenkin ilmoittaa, että R1 1776:n ydinominaisuudet – kuten matemaattinen ja looginen päättely – ovat edelleen samalla tasolla kuin alkuperäisessä mallissa. Testeissä, joissa käytettiin yli 1 000 esimerkkiä, jotka kattoivat laajan valikoiman arkaluontoisia kysymyksiä, malli osoittautui “täysin sensuroimattomaksi” säilyttäen saman tason päättelytarkkuutta kuin DeepSeek R1. Tämä viittaa siihen, että vinouksen poisto (ainakin tässä tapauksessa) ei tullut koko mallin älykkyyden tai kykyjen kustannuksella, mikä on rohkaiseva merkki vastaaville tuleville pyrkimyksille.
- Myönteinen yhteisön vastaanotto ja yhteistyö: Julkaisemalla desensuroitu malli avoimesti Perplexity kutsuu tekoälyyhteisöä tarkastamaan ja parantamaan heidän työtään. Se osoittaa sitoutumista avoimuuteen – tekoälyn vastine “näytä työsi”. Harrastajat ja kehittäjät voivat varmistaa, että sensuurirajoitukset ovat todella poistettu ja potentiaalisesti osallistua tuleviin parannuksiin. Tämä luo luottamusta ja yhteistyöhön perustuvaa innovaatiota alalla, jossa suljetut mallit ja piilotetut säännöt ovat yleisiä.
- Etiset ja geopolitiikkaa koskevat huomioonpanot: Toisaalta sensuurin täydellinen poistaminen herättää monimutkaisia eettisiä kysymyksiä. Yksi välitön huolenaihe on, miten tämä sensuroimaton malli voi olla käytössä tilanteissa, joissa sensuroidut aiheet ovat laittomia tai vaarallisia. Esimerkiksi jos joku Kiinan mannermaalla käyttäisi R1 1776:ta, mallin sensuroimattomat vastaukset Tiananmenin aukion tai Taiwanin tapauksessa voivat asettaa käyttäjän vaaraan. On myös laajempi geopolitiikkaa koskeva signaali: yhdysvaltalaisen yrityksen muokkaaminen kiinalaisperäistä mallia kiinalaisen sensuurin vastaisesti voidaan nähdä rohkeana ideologisena kannanotona. Itse nimitys “1776” korostaa vapauden teemaa, joka ei ole jäänyt huomaamatta. Jotkut kriitikot väittävät, että toisen joukon vinouksien korvaaminen toisella on mahdollista – perustellen, että malli saattaa nyt heijastaa länsimaista näkökulmaa arkaluontoisissa aiheissa. Keskustelu korostaa, että sensuuri vs. avoimuus tekoälyssä ei ole pelkästään tekninen ongelma, vaan myös poliittinen ja eettinen.
Sensuurin poistaminen on pääosin juhlittu askel kohti avoimempia ja maailmanlaajuisesti hyödyllisempiä tekoälymalleja, mutta se toimii myös muistutuksena siitä, että mitä tekoäly pitäisi sanoa, on herkkä kysymys, jolla ei ole yleispätevää sopimusta.

(Lähde: Perplexity AI)
Laajempi kuva: Tekoälynsäätely ja avoimuus
Perplexityn R1 1776:n julkaisu tapahtuu aikana, jolloin tekoälyyhteisö kamppailee tekoälymallien suhteen kiistanalaisen sisällön kanssa. Tekoälymallien sensuuri voi tulla monista lähteistä. Kiinassa tekniikkayritykset ovat velvoitettuja rakentamaan tiukat suodattimet ja jopa kovakoodatut vastaukset poliittisesti arkaluontoisille aiheille. DeepSeek R1 on tämän esimerkki – se oli avoimen lähdekoodin malli, mutta se kantoi selvästi Kiinan sensuurinormien leimaa koulutuksessaan ja hienosäätössä. Sen sijaan useat länsimaisten kehittäjien luomat mallit, kuten OpenAI:n GPT-4 tai Meta LLaMA, eivät ole velvoitettuja noudattamaan Kiinan viranomaisten ohjeita, mutta ne sisältävät silti moderointikerroksia (esim. vihamielisen puheen, väkivallan tai disinformaation suhteen), joita jotkut käyttäjät pitävät “sensuurina”. Rajan kohtuullisen moderoinnin ja ei-toivottavan sensuurin välillä voi olla sumea ja usein riippua kulttuurisesta tai poliittisesta näkökulmasta.
Mitä Perplexity AI teki DeepSeek R1:lle, herättää ajatuksen, että avoimen lähdekoodin malleja voidaan sovittaa eri arvojärjestelmiin tai sääntelyympäristöihin. Teoriassa voisi olla useita versioita mallista: yksi, joka noudattaa kiinalaisia sääntöjä (käytettäväksi Kiinassa), ja toinen, joka on täysin avoin (käytettäväksi muualla). R1 1776 on jälkimmäinen tapaus – sensuroimaton haara, joka on tarkoitettu globaaleille yleisöille, jotka suosivat suodattamattomia vastauksia. Tämänkaltaista haarautumista voidaan tehdä ainoastaan, koska DeepSeek R1:n painot olivat avoimesti saatavilla. Se korostaa avoimen lähdekoodin hyötyä tekoälyssä: avoimuus. Kuka tahansa voi ottaa mallin ja muokata sitä, joko lisäämällä suojaustoimia tai, kuten tässä tapauksessa, poistamalla asetetut rajoitukset. Avoimesti julkaistessa mallin koulutusdataa, koodia tai painoja yhteisö voi tarkastaa, miten malli on muokattu. (Perplexity ei ole paljastanut kaikkia käytettyjä desensurointidataa, mutta julkaisemalla itse mallin he ovat mahdollistaneet muiden havainnoinnin sen käyttäytymistä ja jopa uudelleenkoulutuksen, jos tarve vaatii.)
Tämä tapahtuma viittaa myös laajempiin geopolitiikkaan liittyviin dynamiikoihin tekoälyn kehityksessä. Näemme tietynlaista vuoropuhelua (tai vastakkainasettelua) eri hallintomallien välillä tekoälylle. Kiinalaisen kehittämä malli, jossa on tietty maailmankuva, on otettu yhdysvaltalaisen tiimin toimesta ja muokattu heijastamaan enemmän avoimuuden tietojärjestelmää. Se on todiste siitä, miten globaali ja rajatön tekoälyteknologia on: tutkijat missä tahansa voivat rakentaa toistensa työlle, mutta he eivät ole velvoitettuja kantamaan alkuperäisiä rajoituksia. Ajan myötä saattaisimme nähdä enemmän tällaisia tapauksia – missä malleja “käännätään” tai sovitetaan eri kulttuurisiin konteksteihin. Se herättää kysymyksen siitä, voiko tekoäly koskaan olla todella universaali, vai tulisiko meidän lopulta päätyä aluekohtaisiin versioihin, jotka noudattavat paikallisia normeja. Avoimuus ja läpinäkyvyys tarjoavat yhden polun navigoida tässä: jos kaikki osapuolet voivat tarkastella malleja, ainakin keskustelu vinouksesta ja sensuurista on avoimesti esillä eikä piilotettu yritysten tai hallitusten salassa.
Lopulta Perplexityn siirto korostaa tärkeää pistettä tekoälyn hallintakeskustelussa: kuka päättää, mitä tekoäly voi tai ei voi sanoa? Avoimen lähdekoodin projekteissa tämä valta hajoaa. Yhteisö – tai yksittäiset kehittäjät – voivat päättää, toteutetaanko tiukempia suodattimia tai niiden löysentämistä. R1 1776:n tapauksessa Perplexity päätti, että sensuroimattoman mallin hyödyt ylittivät riskit, ja heillä oli vapaus tehdä tämä päätös ja jakaa tulos julkisesti. Se on rohkea esimerkki siitä, minkälainen kokeilu avoin tekoälykehitys mahdollistaa.












