Modele și platforme AI

Chatbot-urile de inteligență artificială se luptă cu înțelegerea lingvistică

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Apariția chatbot-urilor de inteligență artificială (IA) a reschimbat experiențele conversaționale, aducând progrese care par să se alinieze cu înțelegerea și utilizarea limbajului uman. Aceste chatbot-uri, alimentate de modele lingvistice substanțiale, devin tot mai pricepute în a naviga complexitățile interacțiunii umane.

Cu toate acestea, un studiu recent a adus în lumină vulnerabilitatea persistentă a acestor modele în a distinge limbajul natural de nonsens. Investigarea condusă de cercetătorii de la Universitatea Columbia prezintă perspective intrigante cu privire la posibilele îmbunătățiri ale performanței chatbot-urilor și procesării limbajului uman.

Investigarea modelelor lingvistice

Echipa a elaborat asupra cercetării sale, care a implicat nouă modele lingvistice diferite supuse unor perechi de propoziții. Participanții umani la studiu au fost rugați să discernă propoziția mai “naturală” din fiecare pereche, reflectând utilizarea de zi cu zi. Modelele au fost evaluate în funcție de dacă evaluările lor au rezonat cu alegerile umane.

Când modelele au fost comparate între ele, cele bazate pe rețele neuronale de transformare au arătat o performanță superioară în comparație cu modelele mai simple de rețele neuronale recurente și modelele statistice. Cu toate acestea, chiar și modelele mai sofisticate au demonstrat erori, adesea selectând propoziții percepute ca nonsens de către oameni.

Lupta cu propozițiile nonsens

Dr. Nikolaus Kriegeskorte, un investigator principal la Institutul Zuckerman al Universității Columbia, a subliniat succesul relativ al modelelor lingvistice mari în capturarea aspectelor cheie lipsite de modelele mai simple. El a remarcat: “Faptul că chiar și cele mai bune modele pe care le-am studiat pot fi înșelate de propoziții nonsens arată că calculele lor lipsesc de ceva despre modul în care oamenii procesează limbajul.”

Un exemplu remarcabil din studiu a subliniat modele precum BERT, care au judecat greșit naturalitatea propozițiilor, în contrast cu modele precum GPT-2, care s-au aliniat cu judecățile umane. Imperfecțiunile predominante în aceste modele, după cum a remarcat Christopher Baldassano, doctor în psihologie și profesor asistent la Universitatea Columbia, ridică îngrijorări cu privire la dependența de sistemele IA în procesele de luare a deciziilor, atrăgând atenția asupra “punctelor oarbe” aparente în etichetarea propozițiilor.

Implicații și direcții viitoare

Golurile în performanță și explorarea motivelor pentru care unele modele excelează mai mult decât altele sunt aspecte de interes pentru dr. Kriegeskorte. El crede că înțelegerea acestor discrepanțe poate propulsa semnificativ progresul în modelele lingvistice.

Studiul deschide, de asemenea, căi pentru explorarea posibilității ca mecanismele din chatbot-urile IA să declanșeze noi investigații științifice, ajutând neuroștiinții să descifreze complexitățile creierului uman.

Tal Golan, doctor în filosofie și autorul corespondent al lucrării, a exprimat interesul său de a înțelege procesele de gândire umană, luând în considerare capacitățile în creștere ale instrumentelor IA în procesarea limbajului. “Compararea înțelegerii lor lingvistice cu a noastră ne oferă o abordare nouă pentru a gândi despre modul în care gândim,” a comentat el.

Explorarea capacităților lingvistice ale chatbot-urilor IA a dezvăluit încă provocările persistente în alinierea înțelegerii lor cu cogniția umană.

Eforturile continue de a pătrunde în aceste diferențe și revelațiile ulterioare sunt poziționate nu numai pentru a îmbunătăți eficacitatea chatbot-urilor IA, ci și pentru a descifra multiplele straturi ale proceselor cognitive umane.

Juxtapunerea înțelegerii limbajului bazat pe IA și a cogniției umane pune bazele unor explorări multifacetate, care pot reconfigura percepțiile și avansa cunoașterea în domeniile interconectate ale IA și neuroștiinței.

Alex McFarland este un jurnalist și scriitor de inteligență artificială, care explorează cele mai recente dezvoltări în domeniul inteligenței artificiale. El a colaborat cu numeroase startup-uri de inteligență artificială și publicații din întreaga lume.