AI-mallit ja alustat
Facebook luo luonnollisen kuuloinen avoimen alueen chatbotti, joka on koulutettu 1,5 miljardilla Reddit-viestillä
Facebook (META ) on äskettäin julkaissut avoimen alueen chatbotti, joka on nimeltään ”Blender”. BBC:n mukaan Facebookin Blender on sen suurin koskaan tehty avoimen alueen chatbotti, ja yhtiön mukaan se pystyy näyttämään empatiaa, persoonallisuutta ja tietämystä, ja se suoriutuu paremmin ja tuntuu enemmän ihmisenkaltaiselta kuin muut chatbotit. Blender on käytettävissä kolmessa eri versiossa, joista jokaisella on eri taso kompleksisuutta ja mallin monimutkaisuutta. On 90 miljoonan parametrin neuroverkkomalli, 2,7 miljardin parametrin malli ja 9,4 miljardin parametrin malli. 9,4 miljardin parametrin malli on noin 3,6 kertaa suurempi kuin suurin nykyinen chatbotti.
Facebook väittää, että Blender on ensimmäinen laajasti saatavilla oleva chatbotti, joka yhdistää monimutkaisen ja monipuolisen joukon keskustelutaitoja, kuten tietämys ja empatia. Blender-chatbotti pystyy keskustelemaan monista aiheista ja käymään keskustelun, joka seuraa jopa 14 keskustelukierrosta. Ilmoitettiin, että noin 49 % ihmisistä, jotka keskustelivat chatbottiin, suosi chatbottia ihmisen sijaan.
Blender koulutettiin käyttäen dataa, joka on kerätty julkisista keskusteluista sosiaalisen median sivustoilta, kuten Redditistä. Blenderiä kouluttaneeseen aineistoon kuului noin 1,5 miljardia keskusteluesimerkkiä. Vaikka koulutusdata ja mallin monimutkaisuus mahdollistivat chatbottiin monimutkaiset keskustelut ja enemmän luonnollisen, ihmisenkaltaisen tunteen, ilmestyivät joitakin ongelmia tämän koulutustekniikan seurauksena. Tutkijoiden mukaan Blender vastasi toisinaan keskustelukysymyksiin aggressiivisesti tai loukkaavalla kielellä. Lisäksi chatbotti vastasi joskus valheilla ja keksittyjen tosiasioiden kanssa. Tutkimusryhmä on optimistinen, että mallin muutokset ratkaisevat nämä ongelmat, mutta he halusivat julkaisemalla mallit silti.
Facebookin edustajan mukaan, kuten BBC:n mukaan, “mallien julkaiseminen on välttämätöntä, jotta voidaan saada täydellinen ja luotettava käsitys niiden kyvyistä”.
Facebookin tutkijoiden on edelleen voitettava kaksi suurta haastetta, jotta he voivat onnistua, tekoälykonsulttiyhtiö The Envisionersin toimitusjohtaja Dave Choplinin mukaan. Choplin uskoo, että tutkijoiden on vastattava suuria haasteita jäljitellä monia keskustelun nuansseja, joita ihmiset usein ottaa itsestään selvyytenä, ja että data, jota käytetään mallin kouluttamiseen, voi rajoittaa sitä tavoin, jota Facebookin tutkijat saattavat löytää haasteelliseksi voittaa.
“Vaikka Reddit on loistava alusta, algoritmien kouluttaminen siellä käydyistä keskusteluista tulee antamaan paljon olkiin verrattuna viljaan”, Choplin sanoi.
Facebook teki vertailun oman Blender-chatbottinsa ja Googleen nykyisen chatbottiin, jota kutsutaan Meenaksi. Facebookin blogikirjoitus näytti vertailuja Meenan ja Blenderin välillä, ja Facebookin mukaan noin 75 % vastaajista, jotka olivat käyneet keskustelun Blenderin kanssa, sanoi, että he suosivat pidempää keskustelua Blenderin kanssa Meenan sijaan. Lisäksi noin 67 % vastaajista totesi, että Blender oli luonnollisempi ja enemmän ihmisenkaltaisempi kuin Meena pitkissä keskusteluissa.
Tulevaisuudessa Facebookin tutkimusryhmä haluaa parantaa keskustelukykyä malleissa, suunnittelemalla malleja, jotka voivat tukea pidempiä keskusteluja uusien menetelmien ja arkkitehtuurien avulla. Lisäksi tutkijat pyrkivät ratkaisemaan sukupuolipuolueellisuuden ja mahdollisesti vahingollisen kielen ongelman luomalla parempia luokittelijoita ja edustavampaa koulutusdataa.












