Modele și platforme AI
Noul chatbot Meena de la Google poate purta conversații sensibile și specifice despre aproape orice
Deși asistenții virtuali precum Siri, Alexa și Google Assistant sunt impresionanți și utili, abilitățile lor conversaționale sunt de obicei limitate la primirea unor comenzi și furnizarea de răspunsuri predefinite. Companii precum Google și Amazon (AMZN ) au fost în căutarea unor metode de antrenare și dezvoltare a inteligenței artificiale care să poată face chatbot-urile mai robuste și flexibile, capabile să poarte conversații cu utilizatorii într-un mod mult mai natural. Conform unui raport de la DigitalTrends, Google a publicat recent un articol care demonstrează capacitățile noului său chatbot, numit „Meena”. Conform unui articol de blog de la cercetători, Meena poate purta conversații cu utilizatorii pe aproape orice subiect.
Meena este un chatbot cu domeniu deschis, ceea ce înseamnă că răspunde la contextul conversației și se adaptează la intrări pentru a furniza răspunsuri mai naturale. Majoritatea celorlalți chatbot-i sunt cu domeniu închis, ceea ce înseamnă că răspunsurile lor sunt tematice și limitate la îndeplinirea unor sarcini specifice.
Conform raportului Google, flexibilitatea lui Meena a fost rezultatul unui set masiv de date de antrenare. Meena a fost antrenat pe aproximativ 40 de miliarde de cuvinte extrase din conversații de pe rețelele sociale și filtrate pentru a obține cuvintele cele mai relevante și reprezentative. Google a încercat să rezolve unele dintre problemele găsite în majoritatea asistenților vocali, cum ar fi capacitatea de a gestiona subiecte și comenzi care se desfășoară pe mai multe tururi de conversație, cu utilizatorul care furnizează intrări suplimentare după ce botul a răspuns la o intrare. Acest lucru înseamnă că majoritatea chatbot-urilor nu pot solicita clarificări de la utilizator și, atunci când există o întrebare care nu poate fi interpretată, acestea tind să se bazeze pe rezultatele de pe web.
Pentru a rezolva această problemă, cercetătorii de la Google au permis algoritmilor săi să urmărească contextul conversației, ceea ce înseamnă că poate genera răspunsuri specifice. Modelul a utilizat un codificator care procesează ceea ce s-a spus deja în conversație și un decodificator care creează un răspuns pe baza contextului. Modelul a fost antrenat pe date specifice și nespecifice. Datele specifice sunt cuvinte care sunt strâns legate de declarația anterioară. Așa cum a explicat postarea de blog de la Google:
„De exemplu, dacă A spune «Îmi place tenisul», și B răspunde «E drăguț», atunci enunțul ar trebui să fie marcat «nespecific». Acest răspuns ar putea fi utilizat în zeci de contexte diferite. Dar dacă B răspunde «Și eu, nu pot să am suficient de Roger Federer!», atunci este marcat ca «specific», deoarece se referă strâns la ceea ce se discută.
Datele utilizate pentru antrenarea modelului au constat în șapte „tururi” de conversație. În timpul antrenării, modelul a avut 2,6 miliarde de parametri care au examinat 341 GB de date text pentru a găsi modele, un set de date cu aproximativ 8,5 ori mai mare decât setul de date utilizat pentru antrenarea modelului GPT-2 creat de OpenAI.
Google a raportat modul în care Meena a performant la metrica Sensibilitate și Specificitate Medie (SSA). SSA este o metrică concepută de cercetătorii de la Google și are scopul de a cuantifica capacitatea unei entități conversaționale de a răspunde cu răspunsuri specifice și relevante pe măsură ce conversația progresează.
Scorurile SSA sunt calculate prin testarea unui model împotriva unui număr fix de stimuli și urmărirea numărului de răspunsuri sensibile pe care modelul le-a putut oferi. Scorul modelului este derivat pe baza procentului de răspunsuri sensibile/specifice pe care modelul a putut să le ofere în raport cu stimuli. Răspunsurile generice sunt penalizate. Conform Google, o persoană medie obține aproximativ 86% la SSA, în timp ce Meena a obținut 79%. Un alt model de IA celebru, un agent creat de Pandora Bots, a câștigat Premiul Loebner în recunoașterea faptului că bot-urile sale de IA au atins o comunicare umană sofisticată. Agentul Pandora Bots a obținut aproximativ 56% la testul SSA.
Microsoft (MSFT ) și Amazon încearcă, de asemenea, să creeze chatbot-i mai flexibili și naturali. Microsoft a încercat să creeze dialoguri multiturn în chatbot-i timp de doi ani, achiziționând Semantic Machines, o companie de start-up de IA, pentru a îmbunătăți Cortana. Amazon a organizat recent concurerea Alexa Prize, care a solicitat participanților să proiecteze un bot capabil să converseze timp de aproximativ 20 de minute.










