Interviuri

Jeffrey Lai, Fondator și CEO al IrisGo – Seria de interviuri

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Jeffrey Lai, Fondator și CEO al IrisGo, este un antreprenor în domeniul inteligenței artificiale și un lider de produs cu rădăcini adânci în asistenți inteligenți și tehnologii lingvistice. Înainte de a lansa IrisGo în 2025 și de a deveni Fondator Rezident la AI Fund, Lai a petrecut mai mult de 12 ani la Apple (AAPL ), unde a ajutat la crearea și scalarea lui Siri, servind în final ca Manager de Inginerie Lingvistică pentru Siri. Munca sa s-a concentrat pe avansarea inteligenței artificiale conversaționale multilingve, inclusiv dezvoltarea versiunii în limba chineză a lui Siri. Înainte de a lucra la Apple, a ocupat roluri de inginer la Cisco Systems (CSCO ) și a completat un stagiu la Grupul de Robotică Inteligentă de la Centrul de Cercetare NASA Ames. Cu o carieră care acoperă robotică, software pentru întreprinderi și inteligență artificială pentru consumatori, Lai s-a concentrat constant pe facerea tehnologiilor complexe mai accesibile și mai utile în fluxurile de lucru de zi cu zi.

IrisGo dezvoltă un sistem de operare cu inteligență artificială destinat noii generații de calculatoare personale cu putere de inteligență artificială. În loc să funcționeze ca un chatbot independent, platforma este construită pentru a observa cum utilizatorii efectuează sarcini în aplicații, pentru a învăța aceste fluxuri de lucru și pentru a le automatiza prin intermediul unui asistent inteligent pe dispozitiv. Abordarea sa centrală se concentrează pe permisiunea utilizatorilor de a demonstra o sarcină o singură dată și de a converti apoi procesul într-un flux de lucru reutilizabil, ajutând la reducerea lucrului digital repetitiv. Prin valorificarea capacităților de procesare dedicate ale inteligenței artificiale găsite în calculatoarele moderne cu inteligență artificială, IrisGo își propune să permită o automatizare mai privată, mai reactivă și mai conștientă de context, poziționându-se în cadrul pieței în creștere a sistemelor de inteligență artificială agențice care pot executa sarcini în numele utilizatorilor, în loc să ofere doar recomandări.

După ce a ajutat la crearea lui Siri la Apple, ce experiențe specifice l-au convins că este momentul să lanseze IrisGo, și ce a fost problema cheie în interacțiunea om-calculator pe care a simțit-o ca fiind încă nesoluționată?

Când am construit Siri, am fost incredibil de concentrați pe înțelegerea limbajului natural. Dar Siri a avut dificultăți cu contextul, ceea ce este o provocare deoarece modul în care oamenii lucrează și comunică în realitate este plin de context implicit. Când întrebi un coleg, “Poți să-mi trimiți acel raport?”, el știe care raport. Știe istoria noastră comună, proiectul nostru curent, despre ce am discutat. Siri nu avea această capacitate.

De mulți ani, inteligența artificială a fost proiectată pentru a răspunde utilizatorilor. Scrii ceva, primești un răspuns. Acesta este modelul de interacțiune pe care l-am moștenit de la motoarele de căutare și chatbot-uri. Dar cea mai mare parte a ceea ce oamenii fac efectiv pe un calculator nu este o întrebare, ci un flux de lucru. Compilarea acestui raport. Corelarea acestor foi de calcul. Extrageți date din trei aplicații diferite și formatați-le într-un document. Acest tip de muncă nu se potrivește într-o solicitare.

Ceea ce m-a convins să lansez IrisGo a fost realizarea că industria nu construia pentru cazurile de utilizare de zi cu zi. Toată lumea construia modele mai inteligente, o înțelegere mai bună a limbajului, răspunsuri mai rapide. Dar lacuna fundamentală, unde inteligența artificială poate efectiv face munca, nu doar să răspundă la solicitări, era încă acolo. Aceasta este problema pe care am încercat să o rezolvăm.

Privind înapoi la anii petrecuți lucrând la Siri, ce au fost cele mai importante lecții învățate despre limitările asistenților vocali, în special în ceea ce privește înțelegerea contextului, intenției și comportamentului utilizatorului?

Cea mai importantă lecție pe care am învățat-o este că contextul este totul. Oamenii rareori comunică prin comenzi izolate; solicitările lor sunt modelate de ceea ce lucrează și de ceea ce încearcă să realizeze. Asistenții vocali timpurii au fost proiectați în jurul răspunsului la solicitări individuale, ceea ce funcționează bine pentru multe sarcini, dar este mai puțin eficient pentru munca continuă care se extinde pe multiple aplicații și fluxuri de lucru. Această experiență mi-a învățat că înțelegerea intenției necesită înțelegerea contextului, și această idee a devenit una dintre conceptele fundamentale din spatele IrisGo.

Ceea ce am învățat este că intenția este adesea stratificată. Cineva spune una și înțelege alta, și a obține corect această înțelegere necesită înțelegerea persoanei, nu doar a cuvintelor. Această înțelegere este încorporată în IrisGo de la început.

IrisGo este descris adesea ca un sistem de operare cu inteligență artificială, mai degrabă decât un asistent cu inteligență artificială. Care este diferența, și de ce credeți că industria are nevoie de un nou strat de software pentru era calculatorului cu inteligență artificială?

Un asistent cu inteligență artificială așteaptă să fie utilizat. Îl deschizi, scrii ceva, el răspunde, și apoi se termină. Modelul de interacțiune este esențialmente același cu un motor de căutare, unde utilizatorul face o solicitare și inteligența artificială generează un răspuns.

IrisGo, care este un sistem de operare cu inteligență artificială, lucrează alături de tot ceea ce faci, pe întregul sistem, tot timpul. Are acces la fișierele tale, aplicațiile tale, browserul tău, e-mailul tău. Înțelege cum lucrezi pentru că a fost observând, cu permisiunea ta. Și, în mod crucial, poate acționa, nu doar sfătui.

Gândește-te la ceea ce a făcut Windows pentru calculatoarele personale. Înainte de Windows, trebuia să fii tehnician pentru a utiliza un calculator. Windows a creat un strat universal, intuitiv, între oameni și software. Era calculatorului cu inteligență artificială are nevoie de propriul său strat de acest fel, care să ia puterea brută a modelelor de inteligență artificială și să o facă cu adevărat utilă pentru oamenii care efectuează munca de zi cu zi.

Acesta este IrisGo: stratul de inteligență al calculatorului cu inteligență artificială. Când expediți calculatoare cu inteligență artificială fără acest strat, aveți doar un cip puternic care stă inactiv. Ceea ce aveți nevoie este software care știe cum să-l pună la treabă în numele persoanei care îl utilizează.

Una dintre ideile centrale ale IrisGo este că utilizatorii pot învăța sistemul o sarcină prin demonstrarea unei singure ori. De ce credeți că modelul “observă și învață” este mai natural decât solicitarea sau construirea manuală a fluxurilor de lucru?

Ceea ce face caracteristica “Observă și Învață” atât de puternică este că se bazează pe modul în care ne învățăm unii pe alții. Când îl instruiești pe un nou angajat, nu îi scrii o instrucțiune cu 40 de pași. Îi arăți cum se face ceva o dată, el observă, el învață și apoi preia sarcina. Acesta este modul intuitiv. Acesta este modul natural.

Problema cu solicitarea este că pune sarcina pe utilizator de a articula exact ceea ce dorește, într-un format pe care inteligența artificială îl poate înțelege. Pentru întrebări simple, funcționează bine. Dar pentru fluxuri de lucru complexe, cu multiple pași, care implică fișierele și modul dvs. specific de a face lucrurile? Se poate strica rapid. Majoritatea oamenilor nu pot descrie fluxurile lor de lucru cu suficientă precizie pentru a solicita inteligenței artificiale să le execute corect.

Arătarea este mai ușoară decât spusul. Nu este o idee nouă; este bunul simț. Ceea ce face “Observă și Învață” este aplicarea acestei logici la automatizare. Efectuezi o sarcină o dată, așa cum ai face normal. IrisGo învață modelul. Și de acolo, se ocupă de acel flux de lucru pentru tine.

Majoritatea agenților de inteligență artificială de astăzi necesită încă o configurare și o supraveghere semnificativă. Ce separă un agent autonom adevărat de un chatbot care urmează pur și simplu instrucțiuni?

Răspunsul scurt este că un agent autonom adevărat are propriul său context, ia propriile decizii și continuă să lucreze chiar și atunci când nu este supravegheat.

Un chatbot este proiectat pentru a fi reactiv. Trăiește și moare prin solicitare. Îi dai o instrucțiune, o execută și apoi se oprește. Dacă ceva se schimbă, dacă un pas eșuează sau dacă trebuie să se adapteze, se pierde. Va cere ce să facă mai departe.

Un agent autonom adevărat are un obiectiv, nu doar o instrucțiune. Are context despre mediul în care operează. Poate gestiona excepții. Poate decide dacă să continue, să reîncerce sau să semnaleze ceva pentru revizuire umană. Și, important, poate rula în fundal în timp ce lucrezi la alte lucruri.

Majoritatea ceea ce se vinde ca “agenți de inteligență artificială” astăzi sunt, de fapt, chatbot-uri sofisticate cu pași suplimentari. Diferența dintre aceste produse și adevărata autonomie este enormă. Ceea ce face IrisGo diferit este că pornește de la un model de cum lucrezi, învățat direct din observarea ta, și folosește acest model pentru a lua decizii corecte, nu doar pentru a urma instrucțiuni.

Ați vorbit despre importanța memoriei persistente și a contextului local. De ce sunt aceste capacități esențiale dacă inteligența artificială va depăși răspunsurile la întrebări și va începe să acționeze în numele utilizatorului?

Imaginați-vă angajând un asistent care, în fiecare dimineață, nu-și amintește cine sunteți, la ce lucrați sau cum preferați să fie făcute lucrurile. Ați petrece jumătate din zi reexplicând contextul, și ați deveni extrem de frustrat. Acesta este, în esență, ceea ce toate uneltele de inteligență artificială vă cer să faceți astăzi.

Memoria persistentă înseamnă că sistemul vă cunoaște. Știe proiectele dvs., fluxurile dvs. de lucru, preferințele dvs. și cum s-au schimbat lucrurile în timp. Nu trebuie să restabiliți contextul la fiecare sesiune. Inteligența artificială poartă acest context mai departe.

Contextul local este la fel de critic, deoarece munca dvs. nu trăiește în cloud. Trăiește pe calculatorul dvs., în fișiere, aplicații, e-mailuri, file de browser. IrisGo rulează pe dispozitivul dvs., ceea ce înseamnă că are acces la întregul dvs. mediu de lucru și poate opera în numele dvs. pe tot parcursul acestuia.

Aceste două lucruri împreună — memoria și accesul local — sunt ceea ce permit inteligenței artificiale să înceteze a fi un instrument pe care îl utilizați și să devină un sistem care lucrează pentru dvs. Vedem cum mai multă parte a industriei tehnologice începe să recunoască importanța acestei abordări, inclusiv marile companii de tehnologie, deci este o validare clară a abordării noastre.

Confidențialitatea rămâne una dintre cele mai mari preocupări care înconjoară inteligența artificială. Cum echilibrați nevoia de personalizare și memorie cu așteptările utilizatorilor în jurul securității și proprietății datelor?

Presupunerea că confidențialitatea și personalizarea sunt în tensiune este primul lucru care trebuie contestat. Am construit IrisGo astfel încât personalizarea să poată avea loc pe dispozitiv, nu doar în cloud.

Marea majoritate a procesării IrisGo are loc local, pe calculatorul dvs. Fluxurile dvs. de lucru, fișierele dvs., contextul dvs. rămân cu dvs. Procesarea cloud are loc doar atunci când autorizați-o în mod explicit, și atunci când are loc, este criptată de la capăt la capăt. Sunteți în controlul a ceea ce merge unde.

Acest model face IrisGo mai puternic, deoarece are acces la contextul complet al mediului dvs. de lucru. Și înseamnă că utilizatorii nu trebuie să aleagă între o inteligență artificială utilă și una sigură.

Oamenii au încredere în calculatoarele personale cu lucrări sensibile. Scopul nostru este să facem IrisGo demn de aceeași încredere. Acesta este modul fundamental în care produsul este proiectat.

IrisGo este deja expediat pe calculatoare cu inteligență artificială de la Acer, cu planuri de a se extinde la alți producători. Cât de importante credeți că vor fi parteneriatele de distribuție în determinarea platformelor de inteligență artificială care vor ajunge în cele din urmă la adoptarea mainstream?

Distribuția este absolut critică pentru adoptarea mainstream. Doar uitați-vă la istoria competiției de platforme în tehnologie. Windows a câștigat pentru că a fost pe aproape fiecare calculator. Android a câștigat pentru că a fost sistemul de operare cel mai utilizat pentru dispozitive mobile care nu erau iPhone. Companiile care au încercat să câștige prin calitatea pură a produsului, fără distribuția care să o susțină, nu au reușit în mare parte.

Piața calculatorului cu inteligență artificială urmează un model similar. Când IrisGo este preinstalat pe un dispozitiv, este acolo când deschideți cutia. Nu trebuie să-l căutați, să-l descărcați sau să decideți să-i dați o șansă. Acesta este un avantaj enorm.

Suntem deja în 3 milioane de dispozitive laptop Acer care vor fi expediate anul acesta, și suntem în discuții cu producători de calculatoare de top. Scopul nostru este să fim Sistemul de Operare cu Inteligență Artificială pentru calculatoare, implicit. Această strategie de distribuție este centrală pentru modul în care devenim standardul în această categorie.

Pe măsură ce agenții de inteligență artificială devin capabili să gestioneze facturi, cercetări, rapoarte și alte fluxuri de lucru de afaceri, ce noi provocări de guvernanță, supraveghere și încredere ar trebui organizațiile să se pregătească astăzi?

Prima provocare este auditabilitatea. Când un agent de inteligență artificială completează un flux de lucru, cum ar fi procesarea unei facturi sau generarea unui raport, puteți vedea ce a făcut, de ce l-a făcut și de unde a provenit datele? Acest tip de urmă de audit transparent este esențial pentru conformitate și pentru detectarea erorilor înainte de a se complica.

A doua este definirea limitelor. Care fluxuri de lucru sunt adecvate pentru executarea autonomă, și care necesită revizuire umană? Companiile au nevoie de politici clare în acest sens. Tendința este să lase inteligența artificială să facă tot mai mult, treptat, și apoi să realizeze prea târziu că decizii cu riscuri mari sunt luate fără supraveghere suficientă.

A treia este calibrarea încrederii. Angajații trebuie să înțeleagă ce poate și ce nu poate face inteligența artificială, și când să verifice ieșirile sale, în loc să presupună că sunt corecte. Acesta este un aspect de cultură și de formare, la fel de mult ca și unul tehnologic.

Cred că organizațiile care se pregătesc pentru aceasta astăzi vor avea un avantaj semnificativ, deoarece pe măsură ce capacitățile de inteligență artificială cresc, cadrul de guvernanță va deveni și mai important.

În cinci ani de acum înainte, credeți că oamenii vor petrece încă cea mai mare parte a timpului lor interactând cu inteligența artificială prin interfețe de chat, sau inteligența artificială va dispărea tot mai mult în fundal și va finaliza lucrul fără a fi solicitată?

Traiectoria arată deja că inteligența artificială va continua să se mute în fundal. Modelul spre care ne îndreptăm este acela în care calculatorul dvs. înțelege munca dvs. și se ocupă de piesele repetitive, astfel încât atenția dvs. să fie eliberată pentru lucrurile care necesită realmente implicarea dvs.

Gândiți-vă la modul în care funcționează autopilotul în aviație. Piloții nu sunt implicați în fiecare secundă a fiecărui zbor. Sistemul se ocupă de baza, iar omul se implică atunci când este nevoie de judecată și expertiză. Acesta este viitorul muncii asistate de inteligență artificială. Calculatorul dvs. se ocupă de fluxurile de lucru repetitive, bazate pe reguli. Dvs. vă concentrați pe strategie, creativitate și deciziile care necesită adevărata judecată umană.

În cinci ani de acum înainte, cei mai productivi oameni vor fi cei care lucrează alături de sisteme care înțeleg cum operează utilizatorul. În trecut, oamenii făceau toată munca pe calculatoarele lor. În viitor, calculatorul dvs. va face și el munca pentru dvs.

Mulțumim pentru acest interviu minunat. Citiitorii care doresc să afle mai multe despre IrisGo ar trebui să viziteze IrisGo.

Antoine este un lider vizionar și partener fondator al Unite.AI, condus de o pasiune neclintită pentru modelarea și promovarea viitorului inteligenței artificiale și roboticii. Un întreprinzător serial, el crede că inteligența artificială va fi la fel de disruptivă pentru societate ca și electricitatea și este adesea prins vorbind entuziast despre potențialul tehnologiilor disruptive și AGI.

Ca futurist, el este dedicat explorării modului în care aceste inovații vor modela lumea noastră. În plus, el este fondatorul Securities.io, o platformă axată pe investiții în tehnologii de ultimă generație care redefinesc viitorul și reshapă întregi sectoare.