Interviuri
Dr. Judith Bishop, Director Senior al Specialiștilor în Inteligență Artificială de la Appen – Seria de Interviuri

Dr. Judith Bishop este Director Senior al Specialiștilor în Inteligență Artificială pentru regiunea APAC/SUA la Appen. Ea conduce și dezvoltă o echipă de top de lingviști calificați și experimentați, specialiști în toate modurile de comunicare umană (vorbire, scriere și gest), pentru a furniza date de antrenament pentru inteligența artificială cu o combinație fără precedent de calitate și viteză.
Ce v-a atras inițial către lingvistică?
Am aflat despre lingvistică de la un profesor de engleză preferat de la școală. Eram unul dintre acei copii care sunt la fel de atrași de limbi străine și științe umaniste, precum și de matematică și științe. Lingvistica este știința modului în care funcționează limba, așa că a adus împreună toate aceste interese pentru mine. Ca atât de mulți oameni, odată ce am aflat despre ea, am fost complet captivat. Ce ar putea fi mai fascinant decât modul în care ne comunicăm gândurile și sentimentele unii altora? Lingvistica explorează structurile lingvistice care, în ciuda tuturor diferențelor de sunete și sisteme de scriere, sunt adesea similare în esență, deoarece toate sunt produsul existenței noastre umane comune.
Puteți împărtăși povestea modului în care ați ajuns să lucrați în domeniul inteligenței artificiale?
Am lucrat la Appen din 2004, sprijinind dezvoltarea de produse și servicii de tehnologie lingvistică. De-a lungul acestui timp, inteligența artificială a devenit un cadru cuprinzător, misiune și viziune pentru tehnologie pentru a imita și extinde capacitățile umane de comunicare, raționament și percepție. În 2019, echipa mea și-a schimbat numele în Specialiști în Inteligență Artificială, recunoscând că cunoștințele noastre lingvistice și de limbă sunt esențiale pentru întreprinderea inteligenței artificiale. Datele noastre annotate oferă suport esențial pentru succesul interacțiunilor umane cu produsele și serviciile de inteligență artificială.
Ați lucrat în domeniul inteligenței artificiale timp de peste 16 ani, ce sunt unele dintre cele mai mari schimbări pe care le-ați văzut?
Schimbarea majoră a fost o diversificare a accentului de la dezvoltarea tehnologiei de bază la aplicațiile și cazurile de utilizare din coada lungă. Pentru cea mai mare parte a carierei mele, accentul inteligenței artificiale bazate pe limbă a fost dezvoltarea și rafinarea unui set de bază de modele care imită percepția și producția vorbirii umane, și anume recunoașterea vorbirii, sinteza vorbirii și procesarea limbajului natural. Seturile de date au conformat în general standardelor și convențiilor de etichetare și eșantionare a datelor, cum ar fi cele dezvoltate de consorțiul Speecon (Interfețe conduse de vorbire pentru dispozitive de consum). Aceste standarde au permis dezvoltatorilor de tehnologie de bază să-și benchmark-eze performanța pe structuri de date comune și au sprijinit evoluția rapidă a inteligenței artificiale.
Puteți discuta despre importanța datelor neîncărcate în învățarea automată?
Modelele de învățare automată, indiferent dacă sunt supervizate, nesupervizate sau de învățare prin întărire, vor reflecta prejudecățile prezente în datele pe care sunt antrenate. Alyssa Simpson Rochwerger și Wilson Pang oferă câteva exemple excelente ale acestei probleme în cartea lor recentă, Inteligență Artificială din Lumea Reală. Dacă nu există suficiente date de antrenament pentru un segment al populației, modelul de inteligență artificială va fi mai puțin precis pentru acel segment.
Appen a lansat recent noi seturi de date de antrenament diverse pentru inițiativele de procesare a limbajului natural (NLP). Puteți împărtăși detalii despre modul în care aceste seturi de date vor permite utilizatorilor finali să primească aceeași experiență, indiferent de varietatea limbii, dialect, etnolect, accent, rasă sau gen?
Pentru motivele menționate mai sus, seturile de date sunt necesare pentru a corecta prejudecățile existente în sistemele de producție a inteligenței artificiale, precum și pentru a dezvolta seturi de date mai incluzive pentru sistemele viitoare. Seturile de date Appen pe care le menționați vor sprijini corectarea prejudecăților legate de etnie și etnolecte asociate, cum ar fi engleza vernaculară africană americană. Vor oferi date suplimentare de antrenament pentru a spori reprezentarea acestei populații în modelele de limbaj ale inteligenței artificiale.
Ați avut o carieră fenomenală până acum, în opinia dvs., ce împiedică mai multe femei să se alăture STEM și, în special, inteligenței artificiale?
Lipsa modelelor de rol poate fi un factor puternic (și un cerc vicios). Există o dificultate reală – culturală, socială și practică – în a pătrunde în domenii în care femeile și persoanele de alte genuri diverse nu au încă o prezență profund stabilită și în care respectul pentru ceea ce pot contribui este adesea lipsă. Experiența mea ca lider mi-a arătat de nenumărate ori cât de rezistente, creative și de succes pot fi echipele atunci când sunt incluzive și diverse. Liderii trebuie să fie aventuroși în angajarea lor și curajoși în încrederea lor că pot face față provocărilor aduse modului lor de gândire de perspective diverse, știind că această curaj este puternic corelată cu succesul financiar și corporativ.
Există altceva pe care ați dori să-l împărtășiți despre Appen sau inteligența artificială în general?
Furnizorii de date, cum ar fi Appen, au un potențial puternic de a influența rezultatele inteligenței artificiale în bine, oferind date de antrenament incluzive.
Însă, atingerea obiectivului inteligenței artificiale incluzive va necesita participarea tuturor. Cumpărătorii de date trebuie, de asemenea, să-și recunoască responsabilitatea de a cere explicit – și de a plăti – pentru datele incluzive care vor asigura performanța optimă a sistemelor lor pentru toți utilizatorii din lumea reală. Și cei din comunitățile diverse care furnizează datele lor pentru dezvoltarea inteligenței artificiale trebuie să poată avea încredere în modul în care vor fi utilizate. Construirea acestei încrederi va necesita practici puternice de transparență și etică din partea tuturor celor care manipulează date sensibile.
Mulțumim pentru acest interviu minunat, am învățat multe despre punctele dvs. de vedere asupra inteligenței artificiale și lingvisticii. Citiitorii care doresc să afle mai multe despre Appen ar trebui să viziteze Appen.












