Modele i platformy AI
Facebook tworzy naturalnie brzmiącego chatbota open-domain, wyszkolonego na 1,5 mld postów z Reddit
Facebook (META ) niedawno uruchomił chatbota open-domain o nazwie „Blender”. Jak donosi BBC, Blender Facebooka to największy dotąd chatbot open-domain, a według firmy jest on w stanie wykazać empatię, osobowość i wiedzę, przewyższając i czując się bardziej ludzko niż inne chatboty. Blender jest dostępny do użycia w trzech różnych wariantach, każdy z różnym poziomem złożoności i zaawansowania modelu. Istnieje model neuronowy o 90 milionach parametrów, model o 2,7 miliardach parametrów i model o 9,4 miliardach parametrów. Model o 9,4 miliardach parametrów jest około 3,6 razy większy niż największy obecnie istniejący chatbot.
Facebook twierdzi, że Blender to pierwszy powszechnie dostępny chatbot, który łączy ze sobą złożony, różnorodny zestaw umiejętności konwersacyjnych, takich jak wiedza i empatia. Chatbot Blender jest w stanie omawiać różne tematy i prowadzić rozmowę, która obejmuje do 14 „zwrotów” konwersacyjnych. Jak podaje się, około 49% osób, które wchodziły w interakcje z chatbotem, wolało wchodzić w interakcje z botem zamiast z innym człowiekiem.
Blender został wyszkolony przy użyciu danych zebranych z publicznych konwersacji zebranych z serwisów społecznościowych, takich jak Reddit. Zestaw danych, który posłużył do szkolenia Blendera, obejmował około 1,5 miliarda przykładów konwersacji. Chociaż dane szkoleniowe i zaawansowanie modelu pozwoliły chatbotowi na prowadzenie złożonych dyskusji i posiadanie bardziej naturalnego, ludzkiego charakteru, pojawiły się pewne problemy wynikające z tej techniki szkolenia. Zgodnie z oświadczeniem badaczy, Blender czasami odpowiadał na bodźce konwersacyjne agresywnie lub z używaniem obraźliwego języka. Ponadto chatbot czasami odpowiadał fałszywymi informacjami i zmyślonymi faktami. Zespół badawczy jest optymistycznie nastawiony, że rewizje modelu rozwiążą te problemy, ale postanowili wydać modele takimi, jakimi są.
Zgodnie z oświadczeniem przedstawiciela Facebooka, jak cytuje BBC, „wydawanie modeli jest niezbędne, aby umożliwić pełne i niezawodne spojrzenie na ich możliwości”.
Naukowcy z Facebooka nadal muszą pokonać dwa główne wyzwania, aby odnieść sukces, zgodnie z oświadczeniem szefa firmy konsultingowej w dziedzinie sztucznej inteligencji The Envisioners, Dave’a Choplin. Jak cytuje BBC, Choplin uważa, że badacze będą musieli pokonać główne wyzwania w replikowaniu wielu niuansów konwersacji, które ludzie często przyjmują za pewnik, oraz że dane wykorzystane do szkolenia modelu mogą go ograniczać w sposób, który może być trudny do pokonania przez badaczy Facebooka.
„Jak wielka platforma jest Reddit, szkolenie algorytmów na podstawie rozmów, które się tam znajdują, da dużo słomy wraz z ziarnem”, powiedział Choplin.
Facebook porównał swój chatbot Blender z chatbotem Google (GOOGL ) o nazwie Meena. Post na blogu Facebooka wyświetla porównania między Meeną a Blenderem, a zgodnie z danymi Facebooka około 75% respondentów, którzy prowadzili rozmowę z Blenderem, powiedziało, że wolałoby prowadzić dłuższą rozmowę z Blenderem niż z Meeną. Ponadto około 67% respondentów stwierdziło, że Blender jest bardziej naturalny i ludzki niż Meena w przypadku długich rozmów.
W przyszłości zespół badawczy Facebooka chce poprawić zdolność konwersacyjną modeli, projektując modele, które mogą wspierać jeszcze dłuższe rozmowy przy pomocy nowych funkcji strat i architektur. Ponadto badacze mają na celu rozwiązanie problemu związku z płcią i potencjalnie szkodliwym językiem, tworząc lepsze klasyfikatory i bardziej reprezentatywne dane szkoleniowe.












