Modely a platformy AI
Anthropicův Projekt Deal umožňuje agentům Claude obchodovat s reálnými zbožím
Anthropic 24. dubna zveřejnil výsledky experimentu “Project Deal“, týdenního interního experimentu, ve kterém agenti Claude nakupovali a prodávali reálné předměty jménem 69 zaměstnanců v kanceláři společnosti v San Francisku.
Agenti uzavřeli 186 dohod v hodnotě více než 4 000 dolarů – a studie zjistila, že účastníci reprezentovaní silnějšími modely dosáhli měřitelně lepších výsledků, než si jejich lidské protějšky uvědomovali.
Zjištění, která sepsali výzkumníci Anthropic Kevin K. Troy, Dylan Shields, Keir Bradwell a Peter McCrory, poskytují nejjasnější obraz toho, jak by mohl vypadat trh zprostředkovaný umělou inteligencí, až budou agenti jednat na obou stranách transakce.
Také poukazují na “nepříjemnou implikaci”, se kterou společnost říká, že se bude muset vypořádat, a to dříve, než agentic commerce se stane mainstreamem.
Jak fungoval Projekt Deal
Experiment probíhal po dobu jednoho týdne v prosinci 2025.
Anthropic najal 69 zaměstnanců, každému z nich poskytl “rozpočet” ve výši 100 dolarů (vyplacený po experimentu formou dárkové karty, plus nebo minus hodnota toho, co koupili nebo prodali), a provedl krátký rozhovor s každým dobrovolníkem, aby zjistil, co chtějí prodat, za jakou cenu, co chtějí koupit, a jaký styl jednání by jejich agent měl použít. Anthropic poté tyto odpovědi proměnil v přizpůsobený systémový prompt pro každého agenta.
Anthropic poté spustil čtyři paralelní trhy uvnitř Slack kanálů.
“Ve běhu A a běhu D byl každý agent založen na Claude Opus 4.5, našem tehdy nejlepším modelu,” uvedl tým. “V ostatních dvou bězech (Běh B a Běh C) měli účastníci padesátiprocentní šanci, že jim bude přidělen Claude Haiku 4.5, méně výkonný model.”
Pouze běh A byl “skutečný” běh, ve kterém se skutečně vyměňovaly zboží; ostatní tři běhy byly studijní podmínky a účastníci se o tom nedozvěděli, až do dopočetního dotazníku.
Po nasazení agentů již nebyl žádný člověk zapojen.
Projektový Slack kanál náhodně procházel agenty, umožňoval jim zveřejnit položku k prodeji, učinit nabídku na zboží někoho jiného nebo uzavřít dohodu. Zásadní bylo, že po začátku experimentu již nebyl žádný lidský zásah.
Mezi více než 500 zveřejněnými položkami agenti identifikovali shody, navrhli ceny a uzavřeli dohody autonomně. Lidé se opět objevili až na konci, aby fyzicky vyměnili zboží, o kterém jejich agenti dohodli.
Silnější modely tiše vyjednávají lepší dohody
Hlavní zjištění je přímé: kvalita agenta má význam, a to v dolarech.
Z 161 položek prodaných alespoň ve dvou ze čtyř běhů získal prodávající Opus v průměru o 2,68 dolaru více, zatímco kupující Opus zaplatil v průměru o 2,45 dolaru méně. Když prodávající Opus čelil kupujícímu Haiku, průměrná cena dosáhla 24,18 dolaru, ve srovnání s 18,63 dolaru pro dohody Opus-opus. S mediánovou cenou 12 dolarů a průměrem 20,05 dolaru ve všech bězech společnost Anthropic uvádí, že tyto mezery nejsou zanedbatelné.
Jednotlivé případy byly ostřejší.
Stejný rozbitý skládací kolo, stejný kupující, stejný prodávající: agent Opus získal 65 dolarů, agent Haiku pouze 38 dolarů.
Rubín vyrostlý v laboratoři, prodaný za 65 dolarů, dosáhl pouze 35 dolarů, když jej zpracoval agent Haiku.
Chyť je to, co účastníci nevnímali.
Přes zřejmou cenovou mezeru účastníci s agenty Haiku ohodnotili spravedlnost svých dohod téměř stejně jako uživatelé Opus: 4,06 versus 4,05 na škále spravedlnosti.
“Dvacet osm našich účastníků mělo Haiku v jednom běhu Haiku a Opus a Opus v druhém. A přestože 17 z nich ohodnotilo běh Opus výše než běh Haiku, 11 udělalo opak,” napsala společnost.
Druhý, více protichůdný výsledek: styly vyjednávání, které účastníci požadovali ve svých vstupních rozhovorech, téměř neovlivnily výsledky.
Agresivní prodejci skutečně dostali vyšší ceny, ale pouze proto, že nastavili vyšší počáteční ceny, uvádí Anthropic.
Agresivní pokyny nevytvořily žádnou statisticky významnou podporu pro pravděpodobnost prodeje, prodejní cenu nebo kupní cenu, jakmile byly zohledněny vyšší žádané ceny, které tito uživatelé nastavili. Volba modelu byla důležitější než vyvolání.
Co to znamená pro agentic commerce
Projekt Deal je pilotní projekt, ne produkt, a Anthropic pečlivě zdůrazňuje jeho omezení – samo-vybranou zaměstnaneckou základnu, nízké sázky a žádné adversativní aktéry. Přesto 46 procent účastníků uvedlo, že by zaplatilo za službu tohoto typu, což Anthropic vnímá jako důkaz toho, že agent-zprostředkovaný peer-to-peer obchod není daleko.
Toto načasování je důležité, protože Anthropic jasně směřuje Claudea k spotřebitelským transakcím. Společnost nedávno zveřejnila blogový příspěvek, ve kterém se zavázala udržet konverzace Claude bez reklam, a výslovně schválila agentic commerce, a také buduje podnikovou infrastrukturu, jako je Managed Agents, aby umožnila Claude jednat jménem uživatelů napříč třetími službami. Projekt Deal se objevuje jako výzkumná relikvie, která tiše mapuje režimy selhání té budoucnosti.
Anthropic označuje tři obavy, které rostou z experimentu. První, ve světě s společnostmi místo dobrovolníků, by se motivace vypadaly velmi odlišně. Optimalizace pro pozornost agenta AI by se mohla stát mocným nástrojem, který nemusí nutně fungovat ve prospěch lidí.
Druhá, optimalizace systémů pro pozornost agenta AI – spíše než pro lidskou pozornost – by mohla zavést nové manipulační plochy, včetně jailbreaku a prompt injection.
Třetí, “politické a právní rámce pro modely AI, které jednají jménem našich, dosud neexistují,” píše společnost.
Nevyřešenou otázkou je, zda lze mezeru ve vnímání uzavřít pomocí zveřejnění. Účastníci Projektu Deal nevěděli, který model je reprezentoval, což je přibližně situace, se kterou se uživatelé setkají v jakékoli spotřebitelské verzi. Pokud je mezera ve spravedlnosti mezi Opus a Haiku neviditelná uvnitř samo-vybrané Anthropic pracovní síly, která běží týdenní experiment s 100dolarovými sázkami, bude pravděpodobně neviditelná i v měřítku – pokud trh nebude vyžadovat, aby bylo zveřejněno, který agent jedná jménem koho a na jaké úrovni schopností. To je typ regulační otázky, kterou Anthropic nyní veřejně zve, a je to ta, která se pravděpodobně jako první objeví, až se agent-zprostředkovaný obchod přesune za hranice Slack kanálu v San Francisku.












