Lideri de opinie
Microdozare cu AI cu efecte halucinogene scăzute
Agentforce a sosit. Salesforce (CRM ) a încheiat o nouă ediție a conferinței sale anuale Dreamforce în luna septembrie. Împreună cu mulțimea de participanți — și mulțimea de Waymos care îi transportă prin San Francisco curățat suplimentar — acum avem la dispoziție o mulțime de agenți la îndemână pentru a transforma modul de lucru, controlat în mod elegant în cadrul ecosistemului Salesforce. Deși Dreamforce este întotdeauna un eveniment spectaculos datorită anunțurilor sale bine elaborate despre viitor, acest an a oferit o viziune surprinzător de convingătoare despre modul în care agenții bazati pe inteligență artificială vor revoluționa locul de muncă și experiența clienților.
Să temperăm așteptările noastre pentru un timp. Benioff a reflectat în discursul său, “De ce ar trebui agenții noștri să fie atât de puțin halucinogeni?” Da, ei au datele, metadatele, fluxurile de lucru și o gamă vastă de servicii pentru a se conecta; și atâta timp cât sistemele dvs. trăiesc numai în cadrul Salesforce, sună destul de ideal. Salesforce poate sau nu a inventat ingineria prompturilor, o afirmație pe care Benioff a făcut-o și în discurs, evocând poate monologul “Austin Powers” al lui Dr. Evil despre tatăl său care a inventat semnul întrebării. Dar poate Salesforce să îndeplinească viziunea Agentforce? Dacă o fac, va fi o mare afacere pentru modul în care se desfășoară munca.
Să fim realiști: sistemele și datele noastre nu trăiesc toate în cadrul Salesforce. Dacă viitorul muncii este definit de grupuri de agenți care lucrează împreună, cât de departe pot duce grădinile închise și ecosistemele închise în furnizarea de rezultate în întreaga noastră afacere? Desigur, Apple (AAPL ), Microsoft (MSFT ), Amazon (AMZN ) și o mulțime de alți actori vor să își întindă brațele în jurul oportunității masive a agenților care se află în fața noastră. Dar, așa cum fiecare val de progres tehnic a adus diferite arome de dezbateri închise/deschise, în cele din urmă vom avea nevoie de un standard pentru ca agenții să lucreze împreună unii cu alții dincolo de granițe. Altfel, doar o parte a afacerii dvs. va întâlni această oportunitate.
Ca de obicei, atunci când ne confruntăm cu dilema închis/deschis, să ne uităm la webul deschis ca o cale de urmat. La fel cum aplicațiile de pe telefonul dvs. au nevoie de o vedere web pentru a permite o mulțime infinită de rezultate ale aplicațiilor mobile, același lucru va fi necesar în frontiera multi-agents care urmează. Unelte precum Slack oferă cadre de interfață cu utilizatorul, cum ar fi Block Kit, care pot alimenta interfața cu utilizatorul pentru o interacțiune simplă a agentului, dar nu este conceput pentru a gestiona profunzimea experiențelor moderne ale utilizatorilor. Luați Clockwise Prism ca exemplu. Am construit un agent de programare de nivel următor pentru a găsi timp pentru o întâlnire, chiar dacă nu există “spațiu alb” pe calendarul de mâine. Când îl conectați la alți agenți pentru a ajunge la acea întâlnire imposibilă cu cei mai fierbinți prospecți de vânzări, veți avea nevoie de o modalitate de a confirma sau de a explora o mulțime de opțiuni de programare sofisticate și puternice. Furnizarea unei viziuni web pentru a face acest lucru este calea clară de urmat.
De-a lungul discursului său, Benioff a repetat mantra că nu doriți agenți DIY în cadrul afacerii dvs. Și are dreptate. Întreprinderile doresc fluxuri de lucru controlate și simplificate care furnizează valoare repetabilă. Și totuși, nu doresc să fie blocate într-un siloz. De aceea avem nevoie de un standard deschis pentru viitorul multi-agents. Avem nevoie de o modalitate de încredere pentru ca agenții să interacționeze unii cu alții, să traverseze granițele aplicațiilor și ecosistemelor și să o facă într-un mod care menține afacerile sub controlul experienței lor de produs.
Ai putea fi la fel de probabil să inițiați un set de agenți de lucru dintr-un bilet Atlassian (TEAM ) Jira conectat la un caz de client Salesforce, precum și să inițiați un set de agenți în sens invers, care provine din Salesforce conectat la Atlassian. Pentru ca agenții să lucreze împreună, indiferent de unde provine o solicitare de lucru și în orice direcție, cu o experiență a utilizatorului consistentă, din nou, un standard pentru a face acest lucru este necesar.
Ce altceva ar trebui să fie reprezentat în acest standard? În afara Salesforce, ecosistemul multi-agents de astăzi este un wild west excitant. Zilnic, vedem inovații și modalități noi de conectare și construire a sistemelor de inteligență artificială și a fluxurilor de lucru agenți. O legătură recentă între cadrul de inteligență artificială LangChain și unelte precum Assitant-UI a adus această perspectivă:
“UX este crucial pentru agenți. Toată lumea dorește agenți cu flux de date, interfață cu utilizatorul generativă și omul în buclă în aplicația lor.”
Într-adevăr, am acoperit deja cât de crucială este experiența utilizatorului pentru agenți. Și, desigur, agenții trebuie să poată furniza rapid răspunsuri atunci când lucrează cu alți agenți. Dar ce despre interfața cu utilizatorul generativă și omul în buclă în aplicația lor?
Să începem cu omul în buclă; o altă zonă de acord larg. În timp ce Salesforce și alții vorbesc despre automatizare, aceasta este întotdeauna bazată pe nevoia de a putea aduce un om înapoi în centru atunci când este necesar. Am învățat această lecție și la Clockwise și am construit experiența noastră de agent de programare în jurul unui concept de bază care constă în a putea verifica înapoi cu utilizatorul cu un set propus de opțiuni de programare. Când faceți lucruri complexe, este minunat să ajungeți la automatizarea completă, dar începe pe spatele implicării utilizatorului și a menținerii lui în buclă. Orice standard trebuie să fie construit în jurul unei capacități opționale de a verifica și confirma cu utilizatorul înainte de a continua și, în cele din urmă, să permită automatizarea completă atunci când încrederea este suficient de mare.
Și ce despre interfața cu utilizatorul generativă? Aici aș propune că ceea ce este necesar nu este neapărat interfața cu utilizatorul generativă, ci “interfața cu utilizatorul nativă”. Ceea ce este important este că agentul produce o interfață cu utilizatorul care este nativă și controlată de serviciul/agentul care răspunde la solicitare. Doar serviciul nativ va avea contextul și înțelegerea necesară pentru a renderiza o interfață cu utilizatorul care se leagă de solicitarea agentului. Indiferent dacă această interfață cu utilizatorul este renderizată folosind inteligență artificială generativă sau o altă mecanică non-AI, este lăsată serviciului care răspunde ca detaliu de implementare. Și, așa, aici, credem că standardul deschis trebuie să permită serviciului care răspunde să controleze și să furnizeze interfața cu utilizatorul nativă pentru o solicitare a agentului.
Ce urmează? Suntem încântați să continuăm să examinăm ce ar putea arăta un viitor multi-agents deschis. Am creat un proiect al unui lucru pe care îl numim Protocolul Deschis Multi-Agents (OMAP) și suntem încântați să continuăm conversația. Nu va dura mult până când vor apărea complet noi tipuri de locuri de muncă în care oamenii folosesc agenți pentru a face lucruri în moduri puternice și eficiente. Vârsta descrierii de loc de muncă a Agentului Orchestrator este asupra noastră, și, în timp ce Salesforce pictează o cale convingătoare înainte, vom avea nevoie de o modalitate standard pentru ca agenții să se interconecteze dincolo de granițe.












