Financování

Simile získala více než 200 milionů dolarů při valuaci 2 miliard dolarů na rozšíření simulací lidského chování

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Simile získala více než 200 milionů dolarů v rámci série B financování při valuaci 2 miliardy dolarů, poskytující této firmě z Palo Alta dostatečné finanční prostředky na vývoj umělých inteligencí určených pro simulaci lidského rozhodování.

Greenoaks vedl kolo financování, zatímco stávající investor Index Ventures zvýšil svou podporu. Hanabi, Bain Capital Ventures, A*, Factory a CVS Health Ventures (CVS ) se také vrátili, přičemž Definition se připojil jako nový investor. Financování přichází pouhých pět měsíců po Simile vyšly z utajení s 100 miliony dolarů v rámci série A vedené Index Ventures, což znamená, že celková výše financování společnosti přesahuje 300 milionů dolarů.

Od svého veřejného spuštění Simile uvádí, že zvýšila své příjmy pětkrát, rozšířila se na více než 50 zaměstnanců a provedla desítky milionů simulací pro firmy z žebříčku Fortune 100. Společnost plánuje využít nové financování k dalšímu rozvoji svého základního modelu pro lidské chování, zlepšení spolehlivosti svých simulací a rozšíření platformy napříč odvětvími, včetně zdravotnictví, finančních služeb, spotřebního zboží a médií.

Vytváření umělých inteligencí pro předpověď chování místo generování obsahu

Většina současné generativní umělé inteligence se zaměřuje na vytváření výstupů. Velké jazykové modely mohou vytvářet software, marketingový obsah, obrázky, produktové koncepty a obchodní plány během několika sekund.

Simile se zaměřuje na proces rozhodování, který předchází těmto výstupům. Jejich platforma je určena k pomoci organizacím vyhodnotit, co by měly vytvořit, jak by na to mohla reagovat různá publika a jaké druhy vedlejších účinků by mohly nastat po rozhodnutí.

Společnost se popisuje jako tvůrce základního modelu pro lidské chování, nikoli dalšího obecného jazykového modelu. Místo优化 primárně pro logické odpovědi nebo plynulý text je model trénován na reprezentaci rozdílů v preferencích, zkušenostech, hodnotách a rozhodovacích vzorcích lidí.

Organizace mohou použít platformu k vytvoření srovnatelných scénářů a prozkoumat, jak se stejná simulační populace chová, když se mění proměnné, jako jsou ceny, sdělení, funkce produktu nebo podmínky politiky. Cílem není pouze požádat syntetické respondenty o jejich názory, ale modelovat, jak se chování může měnit napříč různými podmínkami a časem.

Od výzkumu na Stanfordu k podnikové simulační platformě

Technologie Simile vychází z výzkumu provedeného spoluzakladatelem a CEO Joon Sung Parkem a dalšími výzkumníky ze Stanfordu, Michael Bernsteinem a Percy Liangem.

Park byl hlavním autorem článku z roku 2023 „Generative Agents: Interactive Simulacra of Human Behavior “, který představil simulační město obydlené 25 umělými agenty. Každý agent používal proud paměti spolu s mechanismy pro vyhledávání, reflexi a plánování, aby udržoval kontext a určoval své další akce.

Agenti vytvořili vztahy, rozvinuli rutiny a koordinovali činnosti bez toho, aby každá interakce byla explicitně naprogramována. Experiment pomohl stanovit mnoho architektonických nápadů, které se nyní používají v multiagentních simulacích, kde autonomní agenti interagují mezi sebou, místo aby reagovali nezávisle na izolované podněty.

Pozdější výzkum testoval, zda mohou generativní agenti reprodukovat postoje a chování skutečných lidí. Ve studii se 1 052 účastníky výzkumníci vytvořili agenty pomocí kvalitativních rozhovorů a vyhodnotili, jak přesně replikovali odpovědi účastníků.

Agenti dosáhli 85% přesnosti, kterou účastníci prokázali, když sami odpovídali na stejné otázky po dvou týdnech. Tento výsledek neznamená, že lidské chování bylo předpovězeno s 85% absolutní přesností. Znamená to, že agenti se přiblížili k úrovni konzistence lidí, které měli reprezentovat.

Webové stránky Simile také odkazují na pozdější práci, která zahrnuje 2,9 milionu odpovědí z 210 sociálních vědeckých experimentů. Společnost uvádí, že jemné nastavení modelů na této behaviorální datech zlepšilo shodu na předtím neviditelných studiích o 26% ve srovnání se základním modelem.

Důvěrné skóre jsou centrální pro produkt

Jedním z technických tvrzení Simile je, že vycvičila samostatný model důvěry, aby odhadla spolehlivost každé simulace.

Předpověď lidského chování je inherentně nejistá. Stejná osoba může učinit různé rozhodnutí v závislosti na čase, kontextu, dostupných informacích a faktorech, které nejsou přítomny v datech. Systém, který produkuje jedinou jistou předpověď bez komunikace omezení, by mohl povzbudit organizace, aby považovaly simulační chování za fakt.

Simile uvádí, že její platforma srovnává simulační distribuce odpovědí se skutečnými odpověďmi shromážděnými z lidí pomocí Total Variation Distance, statistické míry rozdílu mezi dvěma pravděpodobnostními distribucemi. Každý výsledek obdrží důvěrné skóre na základě množství a relevance podpůrných lidských důkazů.

Když je důkaz pro konkrétní populaci nebo scénář omezený, důvěrné skóre má za úkol učinit tuto nejistotu viditelnou. Společnost také uvádí, že její modely jsou rekvalifikovány týdně, aby zahrnovaly změny v oblastech, jako jsou ceny, politika, ekonomické podmínky a spotřebitelské chování.

Tato validační vrstva by mohla být stejně důležitá jako samotné simulace. Pro podniky, které činí drahá nebo citlivá rozhodnutí, může být znalost toho, kdy je model nedůvěryhodný, stejně cenná jako obdržení další pravděpodobné předpovědi.

CVS Health používá simulace k testování rozhodnutí před spuštěním

CVS Health je jedním z nejvýznamnějších raných zákazníků Simile a také se zúčastnil kola financování prostřednictvím CVS Health Ventures.

Zdravotnická společnost používala simulační populace k ověření stávajícího zákaznického výzkumu, prozkoumání faktorů ovlivňujících spokojenost pacientů a testování strategií souvisejících s dodržováním léčby. Také prozkoumala populace, které jsou obtížně nebo nákladně dostupné prostřednictvím tradičních průzkumů, včetně pacientů s chronickými onemocněními.

Podle Simile iniciativa CVS vychází z 2,9 milionu souhlasných odpovědí od více než 400 000 účastníků napříč více než 200 behaviorálními scénáři. Simulace byly použity k předběžnému výběru nápadů a identifikaci hypotéz, které vyžadují další testování prostřednictvím reálného výzkumu nebo pilotních studií.

Tato distinkce je důležitá. Simulace mohou snížit počet nápadů, které je třeba testovat přímo se zákazníky, ale nevyřazují potřebu shromažďovat reálné důkazy. CVS popsala technologii jako způsob, jak priorizovat výzkum a rafinovat potenciální intervence předtím, než jsou pacienti nebo zákazníci vystaveni jim.

Simile také spolupracuje s Gallupem na politickém výzkumu, studiích pracovišť a analýze sociálních trendů. Další organizace, které jsou uvedeny společností, zahrnují Wealthfront, Deloitte, Banco Itaú a Suntory. Podniky používají platformu pro oblasti, jako je testování produktů, vstup na trh, výzkum zákaznické zkušenosti, konkurenční позиcionování a příprava na výnosové hovory.

Přechod z jednotlivých agentů k simulačním trhům

Mnohé současné aplikace Simile připomínají urychlený marketingový výzkum. Společnost může otestovat několik produktových konceptů nebo sdělení proti simulační populaci, než se rozhodne, které z nich si zaslouží reálnou kampaň nebo pilotní studii.

Dlouhodobá příležitost je podstatně složitější. Simile chce modelovat interakce mezi zákazníky, konkurenty, institucemi, politikami a trhy. Místo předpovědi, jak izolovaní jednotlivci budou reagovat na otázku, by tyto multiagentní simulace prozkoumaly, jak lidé ovlivňují jeden druhého a jak rozhodnutí produkují kaskádové účinky.

Možné aplikace by mohly zahrnovat modelování reakcí na finanční šoky, změny politiky, spuštění produktů nebo změny v pobídkách. Simulace by mohla prozkoumat, zda zákazníci přijmou novou službu, a jak tato adopce změní chování konkurentů, veřejné vnímání a poptávku po souvisejících produktech.

Toto je oblast, kde se technické omezení stanou významnější. Malé chyby se mohou kumulovat, když tisíce nebo miliony agentů interagují, zejména ve simulacích, kde rané události mění trajektorii všeho, co následuje. Simile bude muset prokázat, že její validační metody zůstávají smysluplné, jakmile se simulace přesunou od individuálních předpovědí k komplexním, dynamickým systémům.

Nová vrstva rozhodovací infrastruktury

Velikost a rychlost posledního kola financování Simile naznačují, že investoři považují simulační chování za potenciální novou vrstvu v podnikovém rozhodování.

Organizace již nyní hodně investují do průzkumů, konzultací, focus group, produktových testů a marketingového výzkumu. Simulace umělých inteligencí by mohly učinit levnější prozkoumání více možností, testování užších segmentů publika a identifikaci slabých nápadů předtím, než se zavážou do významných investic.

Technologie také zavede obtížné otázky kolem souhlasu, reprezentace a odpovědnosti. Simulační populace je pouze tak užitečná, jako lidé, chování a okolnosti reprezentované v jejích podkladových datech. Předpovědi mohou být méně spolehlivé, když jsou nasazeny napříč neznámými kulturami, rychle se měnícími trhy nebo vysoce rizikovými situacemi s omezenou historickou precedencí.

Proto může být nejsilnější roli pro platformy, jako je Simile, v blízké budoucnosti doplnit lidský výzkum, spíše než ho nahradit. Simulace mohou pomoci organizacím rozhodnout, které otázky prozkoumat, ale skuteční zákazníci a komunity zůstávají nezbytné pro ověření, zda výsledky platí mimo model.

Simile získala nové financování, které jí poskytne zdroje k testování, zda může simulační chování lidského chování pokročit z výzkumného pole do spolehlivé podnikové infrastruktury. Jejím bezprostředním výzvou není pouze spuštění více simulací, ale prokázání, že organizace mohou pochopit své limity a vědět, kdy jsou výsledky dostatečně spolehlivé, aby ovlivnily významná rozhodnutí.

Antoine je vizionářský líder a spoluzakladatel Unite.AI, který je poháněn neotřesitelnou vášní pro formování a propagaci budoucnosti umělé inteligence a robotiky. Jako sériový podnikatel věří, že umělá inteligence bude mít na společnost stejně disruptivní vliv jako elektřina, a často se chvála na potenciál disruptivních technologií a AGI.