Myslitelé

Mikrodávkování na nízko halucinogenním AI

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Agentforce je zde. Salesforce (CRM ) uzavřel další ročník své roční konference Dreamforce v září. Společně s davem účastníků — a davem Waymů, kteří je vozili kolem extračistého San Francisca — nyní máme k dispozici dav agentů na našich prstech, abychom transformovali práci, pěkně ovládanou v rámci ekosystému Salesforce. Zatímco Dreamforce je vždy spektáklem pro své marketingově vytříbené prohlášení o budoucnosti, letošní ročník poskytl neočekávaně přesvědčivou vizi toho, jak agenti založení na AI budou revolucionalizovat pracovní prostředí a zákaznickou zkušenost.

Dovolme si naše očekávání trochu zmírnit. Benioff se ve své keynote ptal: „Proč by naši agenti měli být tak nízko halucinogeničtí?“ Ano, mají data, metadata, pracovní postupy a širokou škálu služeb, do kterých se mohou připojit; a pokud vaše systémy žijí pouze v rámci Salesforce, zní to bastante ideálně. Salesforce možná vynalezl prompt engineering, o čemž Benioff také hovořil ve své keynote, možná jako „Austin Powers“ Dr. Evil monolog o svém otci, který vynalezl otazník. Ale může Salesforce splnit vizi Agentforce? Pokud ano, bude to velký úspěch pro to, jak se práce provádí.

Dovolme si být realisté: naše systémy a data nežijí všechny v rámci Salesforce. Pokud je budoucnost práce definována skupinami agentů, kteří spolupracují, jak daleko můžeme jít s uzavřeným ekosystémem a hranicemi? Určitě Apple (AAPL ), Microsoft (MSFT ), Amazon (AMZN ) a řada dalších chce obejmout obrovskou příležitost agentů před námi. Ale jak každá vlna technického pokroku přinesla různé varianty debat o otevřenosti a uzavřenosti, nakonec budeme potřebovat standard pro agentů, kteří spolupracují s ostatními přes hranice. Jinak pouze část vašeho podnikání bude moci využít této příležitosti.

Jako často činíme, když jsme konfrontováni s otevřeným/closed dilematem, podívejme se na otevřený web jako cestu vpřed. Stejně jako aplikace na vašem telefonu potřebují prohlížeč, aby ermögňovaly nekonečné množství mobilních aplikací, totéž bude zapotřebí v nadcházející multi-agentní frontě. Nástroje jako Slack poskytují UI frameworky, jako je Block Kit, které mohou pohánět uživatelské rozhraní pro jednoduchou interakci agenta, ale nejsou vhodné pro zpracování hloubky moderních uživatelských zkušeností. Vezměme si Clockwise Prism jako příklad. Vyvinuli jsme next-level scheduling agenta pro nalezení času pro setkání, i když není žádný aktuální „bílý prostor“ v kalendáři na zítřek. Když ho připojíme k ostatním agentům, abychom dosáhli nemožného setkání s našimi nejžhavějšími prodejními prospekty, budete potřebovat způsob, jak buď potvrdit nebo prozkoumat řadu sofistikovaných a silných možností plánování. Poskytnutí prohlížeče pro toto je jasná cesta vpřed.

Během své keynote Benioff opakoval mantru, že nechcete DIY agenty ve vašem podnikání. A má pravdu. Podniky chtějí kontrolované a zjednodušené pracovní postupy, které poskytují opakované hodnoty. A přesto nechtějí být uvězněny v silu. To je důvod, proč potřebujeme otevřený standard pro multi-agentní budoucnost. Potřebujeme spolehlivý způsob, jak agenti mohou interagovat s ostatními, překračovat hranice aplikací a ekosystémů a dělat to způsobem, který udržuje podniky v kontrolě nad jejich produkční zkušeností.

Můžete být stejně pravděpodobně spustit sadu pracovních agentů z dentro Atlassian (TEAM ) Jira ticketu spojeného se Salesforce zákaznickým případem, jako byste chtěli spustit sadu agentů v opačném směru, vycházejících ze Salesforce spojeného s Atlassian. Aby agenti mohli spolupracovat bez ohledu na to, odkud pochází žádost o práci a v jakémkoli směru s konzistentní uživatelskou zkušeností, opět je zapotřebí standard pro toto.

Co jiného by mělo být zastoupeno v tomto standardu? Mimo Salesforce je multi-agentní ekosystém dnes vzrušujícím divokým západem. Denně vidíme nové inovace a způsoby, jak propojit a konstruovat AI systémy a agentní pracovní postupy. Jedním z nedávných propojení mezi AI frameworkem LangChain a nástrojem zvaným Assitant-UI přišlo toto zjištění:

„UX je zásadní pro agenty. Všichni chtějí agenty s proudem, generativním UI a člověkem v smyčce ve své aplikaci.“

Skutečně, již jsme diskutovali o tom, jak zásadní je uživatelská zkušenost pro agenty. A jasně agenti musí být schopni rychle proudit své odpovědi, když pracují s ostatními agentkami. Ale co generativní UI a člověk v smyčce ve své aplikaci?

Dovolme si začít s člověkem v smyčce; další oblast široké shody. Zatímco Salesforce a ostatní hovoří o velkém automatizaci, je vždy založeno na potřebě být schopni přivést člověka zpět do centra, když je to nutné. Naučili jsme se tuto lekci také v Clockwise a vyvinuli jsme naší scheduling agent zkušenost kolem jádra konceptu být schopni zkontrolovat zpět u uživatele s navrhnutou sadou plánovacích možností. Když děláte komplexní práci, je úžasné dosáhnout plné automatizace, ale začíná na základě zapojení uživatele a udržování jej v smyčce. Jakýkoli standard musí být postaven kolem opcionálního schopnosti zkontrolovat a potvrdit s uživatelem před pokračováním a nakonec umožnit plnou automatizaci, když je důvěra dostatečně vysoká.

A co generativní UI? Zde bych navrhl, že co je zapotřebí, není nutně generativní UI, ale „rodinné UI“. Co je důležité, je to, že agent produkuje UI, které je rodinné a kontrolované službou/agentem, který reaguje na žádost. Pouze rodinná služba bude mít kontext a porozumění nezbytné pro vykreslení uživatelského rozhraní, které se váže k agentovi žádosti. Zda je toto UI vykresleno pomocí generativního AI nebo nějakého jiného non-AI mechanismu, je ponecháno na odpovědné službě jako implementační detail. A tak zde si myslíme, že otevřený standard musí umožnit odpovědné službě kontrolovat a dodávat rodinné UI pro agenta žádosti.

Co přijde dál? Jsme nadšeni pokračovat v zkoumání, co by mohla vypadat otevřená multi-agentní budoucnost. Vyvinuli jsme návrh něčeho, co nazýváme Otevřený multi-agentní protokol (OMAP) a jsme nadšeni pokračovat v rozvoji konverzace. Nebude to dlouho, než budou zcela nové typy pracovních míst, kde lidé budou používat agenty k provádění práce silným a streamovaným způsobem. Věková agenta Orchestrátor je zde, a zatímco Salesforce maluje přesvědčivou cestu vpřed, budeme potřebovat standardní způsob, jak agenti mohou interagovat za hranicemi.

Gary Lerhaupt je spoluzakladatel a technický ředitel společnosti Clockwise. V roce 2024 pomohl vybudovat Prism, inteligentní kalendář společnosti Clockwise poháněný umělou inteligencí. Předtím byl viceprezidentem pro inženýrství ve společnosti RelateIQ (získané společností Salesforce). Vystudoval bakalářský titul v oboru počítačových věd na Ohijské státní univerzitě a magisterský titul v oboru počítačových věd na Stanfordově univerzitě.