AI-modeller och plattformar
Facebook Skapar Naturligt Ljudande Öppen-Domän-Chatbot Tränad På 1,5 Miljarder Reddit-Inlägg
Facebook (META ) har nyligen lanserat en öppen-domän-chatbot som kallas “Blender”. Enligt BBC är Facebooks Blender deras största öppen-domän-chatbot hittills och enligt företaget kan den visa empati, personlighet och kunskap, och överträffar och känns mer mänsklig än andra chatbotar. Blender är tillgänglig för användning i tre olika varianter, var och en med en annan nivå av komplexitet och modellsofistikation. Det finns en 90 miljoner parametrar neural modell, en 2,7 miljarder parametrar modell och en 9,4 miljarder parametrar modell. Den 9,4 miljarder parametrar modellen är ungefär 3,6 gånger större än den största befintliga chatboten.
Facebook hävdar att Blender är den första allmänt tillgängliga chatboten som kombinerar en komplex, diversifierad uppsättning konversationsförmågor som kunskap och empati. Blender-chatboten kan diskutera en mängd olika ämnen och föra en konversation som spårar upp till 14 konversations-“vändningar”. Enligt rapporter föredrog ungefär 49% av de människor som interagerade med chatboten att interagera med boten istället för en annan människa.
Blender tränades med data som samlats in från offentliga domäner från sociala medieplatser som Reddit. Datamängden som användes för att träna Blender innehöll ungefär 1,5 miljarder exempel på konversationer. Medan träningsdata och modellens sofistikation möjliggjorde att chatboten kunde föra komplexa diskussioner och ha en mer naturlig, mänsklig känsla, uppstod det några problem som ett resultat av denna träningsmetod. Enligt forskarna svarade Blender ibland aggressivt eller med stötande språk på konversationsprompt. Dessutom svarade chatboten ibland med osanningar och påhittade fakta. Forskningsgruppen är optimistisk om att revideringar av modellen kommer att hantera dessa problem, men de ville ändå släppa modellerna.
Enligt en Facebook-talesperson, citerad av BBC, “är det viktigt att släppa modeller för att möjliggöra fullständiga och tillförlitliga insikter i deras förmågor”.
Facebook-forskarna måste fortfarande övervinna två stora utmaningar för att lyckas, enligt Dave Choplin, vd för artificiell intelligens-konsultföretaget The Envisioners. Enligt Choplin, citerad av BBC, tror han att forskarna kommer att möta stora utmaningar i att replikera de många nyanserna i konversationer som människor ofta tar för givet och att data som används för att träna modellen kan hämma den på sätt som Facebooks forskare kan ha svårt att övervinna.
“Så bra plattform som Reddit är, så kommer träning av algoritmer baserat på konversationer du hittar där att ge dig mycket skräp bland vetet”, sade Choplin.
Facebook gjorde jämförelser mellan sin egen Blender-chatbot och Googles samtida chatbot som kallas Meena. Facebooks blogginlägg visade jämförelser mellan Meena och Blender, och enligt Facebooks data sa ungefär 75% av respondenterna som hade fört en konversation med Blender att de hellre ville ha en längre diskussion med Blender än Meena. Dessutom sa ungefär 67% av respondenterna att Blender var mer naturlig och mänsklig än Meena när det gällde långa konversationer.
I framtiden vill Facebooks forskningsteam förbättra konversationsförmågan hos modellerna, genom att utforma modeller som kan stödja ännu längre konversationer med hjälp av nya förlustfunktioner och arkitekturer. Dessutom syftar forskarna till att hantera könsbias och potentiellt skadligt språk genom att bygga bättre klassificerare och mer representativ träningsdata.












