Liderzy opinii

Mikrodawkanie na nisko-hallucynogenne AI

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Agentforce jest już tu. Salesforce (CRM ) zakończył kolejną edycję swojej corocznej konferencji Dreamforce we wrześniu. Dołączając do tłumów uczestników — i tłumów Waymos, które wożą ich po dodatkowo czystym San Francisco — każdy z nas ma teraz rój agentów u swoich palców, aby przekształcić pracę, ładnie kontrolowaną w ramach ekosystemu Salesforce. Chociaż Dreamforce jest zawsze spektaklem ze względu na swoje marketingowe deklaracje dotyczące przyszłości, ten rok przyniósł nieoczekiwanie przekonywującą wizję tego, jak agenci oparte na sztucznej inteligencji mają zrewolucjonizować miejsce pracy i doświadczenie klienta.

Uspokójmy nasze oczekiwania na chwilę. Benioff zastanawiał się podczas swojego przemówienia, „Dlaczego nasi agenci mieliby być tak nisko-hallucynogenne?” Tak, mają dane, metadane, przepływy pracy i ogromny zestaw usług, które mogą połączyć; i tak długo, jak Twoje systemy żyją tylko w ramach Salesforce, brzmi to dość idealnie. Salesforce może lub nie wymyślił inżynierię promptów, co również twierdził Benioff w swoim przemówieniu, ewokując może „Austin Powers” Dr. Evil monolog o tym, jak jego ojciec wymyślił znak zapytania. Ale czy Salesforce może spełnić wizję Agentforce? Jeśli tak, będzie to duży interes, jeśli chodzi o to, jak praca się odbywa.

Bądźmy jednak realistami: nasze systemy i dane nie żyją wszystkie w ramach Salesforce. Jeśli przyszłość pracy jest definiowana przez grupy agentów pracujących razem, jak daleko mogą nas zaprowadzić zamknięte ogrody i zamknięte ekosystemy w dostarczaniu wyników w całym naszym biznesie? Z pewnością Apple (AAPL ), Microsoft (MSFT ), Amazon (AMZN ) i wiele innych chce objąć ogromną okazję agenta przed nami. Ale tak jak każda fala postępu technologicznego przyniosła różne smaki debat otwartych i zamkniętych, ostatecznie będziemy potrzebować standardu dla agentów, którzy współpracują ze sobą ponad granicami. W przeciwnym razie tylko części Twojego biznesu spotkają się z tą okazją.

Jak często robimy, gdy stajemy wobec dylematu otwartego i zamkniętego, spójrzmy na otwarty internet jako sposób do przodu. Tak jak aplikacje na Twoim telefonie potrzebują widoku internetowego, aby umożliwić nieskończoną liczbę wyników aplikacji mobilnych, to samo będzie potrzebne w nadchodzącej wieloagentowej granicy. Narzędzia takie jak Slack dostarczają ramy interfejsu użytkownika, takie jak Block Kit, które mogą napędzać interfejs użytkownika dla prostej interakcji agenta, ale nie są one przystosowane do obsługi głębi nowoczesnych doświadczeń użytkownika. Weźmy na przykład Clockwise Prism. Zbudowaliśmy następny poziom agenta do planowania, aby znaleźć czas na spotkanie, nawet jeśli nie ma obecnie „białego miejsca” w kalendarzu jutro. Gdy podłączysz go do innych agentów, aby umieścić to niemożliwe spotkanie z Twoimi najgorętszymi prospectami, będziesz potrzebować sposobu, aby albo potwierdzić, albo zbadać wiele zaawansowanych i potężnych opcji planowania. Zapewnienie widoku internetowego do tego jest wyraźną drogą do przodu.

Przez całe swoje przemówienie Benioff powtarzał mantrę, że nie chcesz agentów DIY w swoim biznesie. I ma rację. Przedsiębiorstwa chcą kontrolowanych i uproszczonych przepływów pracy, które dostarczają powtarzalną wartość. I nie chcą być zakleszczone w silosie. Dlatego potrzebujemy otwartego standardu dla wieloagentowej przyszłości. Potrzebujemy niezawodnego sposobu, aby agenci mogli ze sobą współpracować, przekraczać granice aplikacji i ekosystemów, i robić to w sposób, który pozwala firmom kontrolować swoje doświadczenie produktowe.

Możesz być równie prawdopodobnie wywołać zestaw agentów pracy z wniosku Atlassian (TEAM ) Jira połączonego z przypadkiem klienta Salesforce, jak i wywołać zestaw agentów w odwrotnym kierunku, pochodzących z Salesforce połączonego z Atlassian. Aby agenci mogli współpracować niezależnie od tego, skąd pochodzi wniosek o pracę, i w dowolnym kierunku zgodnym z doświadczeniem użytkownika, ponownie potrzebny jest standard do tego.

Co jeszcze powinno być reprezentowane w tym standardzie? Poza Salesforce, wieloagentowy ekosystem dzisiaj jest ekscytującym dzikim zachodem. Na co dzień widzimy nowe innowacje i sposoby łączenia i konstruowania systemów sztucznej inteligencji i agentowych przepływów pracy. Jeden z niedawnych powiązań między frameworkiem AI LangChain a narzędziem o nazwie Assitant-UI przyniósł tę wgląd:

„UX jest kluczowy dla agentów. Każdy chce agentów z transmisją strumieniową, generatywnym interfejsem użytkownika i pętlą ludzką w swojej aplikacji.”

Rzeczywiście, już omówiliśmy, jak kluczowy jest interfejs użytkownika dla agentów. I oczywiście agenci muszą być w stanie szybko transmitować swoje odpowiedzi, pracując z innymi agentami. Ale co z generatywnym interfejsem użytkownika i pętlą ludzką w ich aplikacji?

Zacznijmy od pętli ludzkiej; innego obszaru szerokiej zgody. Podczas gdy Salesforce i inni mówią o dużej gry o automatyzacji, jest to zawsze ugruntowane w potrzebie możliwości powrotu do człowieka, gdy jest to konieczne. Nauczyliśmy się tej lekcji w Clockwise i zbudowaliśmy nasze doświadczenie agenta do planowania wokół podstawowego pojęcia, aby móc sprawdzić z powrotem u użytkownika z proponowanym zestawem opcji planowania. Gdy wykonujesz złożoną pracę, jest niesamowite, aby uzyskać pełną automatyzację, ale zaczyna się od zaangażowania użytkownika i utrzymania go w pętli. Każdy standard musi być zbudowany wokół opcjonalnej możliwości sprawdzenia i potwierdzenia z użytkownikiem przed kontynuowaniem, i ostatecznie umożliwić pełną automatyzację, gdy zaufanie jest wystarczająco wysokie.

I co z generatywnym interfejsem użytkownika? Tutaj proponuję, że to, co jest potrzebne, nie jest koniecznie generatywnym interfejsem użytkownika, ale „rodzimym interfejsem użytkownika”. To, co jest ważne, to to, że agent produkuje interfejs użytkownika, który jest rodzimy i kontrolowany przez usługę/agenta, który odpowiada na wniosek. Tylko usługa rodzima będzie miała kontekst i zrozumienie niezbędne do renderowania interfejsu użytkownika, który łączy się z wnioskiem agenta. Czy ten interfejs użytkownika jest renderowany przy użyciu generatywnej sztucznej inteligencji, czy jakiegoś innego nie-AI mechanizmu, jest pozostawione do usługi odpowiedzialnej jako szczegół implementacji. I tak, myślimy, że otwarty standard musi pozwolić usłudze odpowiedzialnej na kontrolowanie i dostarczanie rodzimego interfejsu użytkownika do wniosku agenta.

Co dalej? Jesteśmy podekscytowani, aby kontynuować badanie, jak może wyglądać otwarta wieloagentowa przyszłość. Stworzyliśmy projekt czegoś, co nazywamy Otwarty Protokół Wieloagentowy (OMAP) i jesteśmy podekscytowani, aby kontynuować rozmowę. Nie będziemy długo czekać, zanim pojawią się całkowicie nowe typy pracy, w których ludzie używają agentów do pracy w potężnych i uproszczonych sposobach. Wiek opisu pracy Agent Orchestrator jest przed nami, a podczas gdy Salesforce maluje przekonywującą ścieżkę do przodu, będziemy potrzebować standardowego sposobu, aby agenci mogli łączyć się ponad granicami.

Gary Lerhaupt jest współzałożycielem i dyrektorem technicznym Clockwise. W 2024 roku pomógł zbudować Prism, inteligentny kalendarz Clockwise napędzany przez AI. Był wcześniej wiceprezesem ds. inżynierii w RelateIQ (nabytym przez Salesforce). Ma tytuł licencjata z informatyki na Ohio State oraz tytuł magistra z informatyki na Uniwersytecie Stanforda.