Modely a platformy AI

Vědecký pracovník Amazon Alexa tvrdí, že Turingův test je zastaralý

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Rohit Prasad, viceprezident a hlavní vědec Alexa v Amazonu, nedávno argumentoval, že Turingův test, který se dlouho používal k měření sofistikovanosti modelů umělé inteligence, by měl být vyřazen jako měřítko pro umělou inteligenci.

Computerový vědec a matematik Alan Turing původně zavedl koncept Turingova testu před více než 70 lety. Účelem Turingova testu bylo pomoci zodpovědět otázku strojové inteligence, zda je stroj schopen „myšlení“ ve smyslu lidském. Aby se tato otázka zodpověděla, Turing argumentoval, že pokud stroje mohou vykazovat konverzační chování tak sofistikované, že lidský pozorovatel nemůže rozlišit mezi dialogem počítače a lidským dialogem, měl by být stroj považován za schopný myšlení.

Omezení Turingova testu

Prasad argumentoval, že Turingův test je omezen mnoha způsoby a že Turing sám dokonce zmínil některé z těchto omezení ve své počáteční práci. Jak se umělá inteligence stala více a více integrovanou do všech aspektů našeho života, lidé se méně zajímají o to, zda je umělá inteligence nerozlišitelná od člověka, a více o tom, zda jejich interakce s umělou inteligencí jsou bezproblémové, argumentuje Prasad. Z tohoto důvodu by měl být Turingův test považován za zastaralý a nahrazen více užitečnými měřítky.

Prasad poznamenal, že mnoho raných chatbotů bylo navrženo s ohledem na úspěšné absolvování Turingova testu, a v posledních letech některé chatboty úspěšně oklamaly více než třetinu lidských soudců (což bylo vyžadováno k absolvování Turingova testu). Nicméně být schopný úspěšně napodobit řečové vzorce lidí neznamená, že stroj může být skutečně považován za „inteligentní“. Modely umělé inteligence mohou být extrémně zdatné v jedné oblasti a extrémně nedostatečné v jiných, aniž by měly jakoukoli formu obecné inteligence. Přesto zůstává Turingův test běžně používaným měřítkem pro chatboty a digitální asistenty, s Prasadem, který poznamenává, že obchodní lídři a novináři neustále ptají, kdy bude Alexa schopna absolvovat Turingův test.

Podle Prasada je jedním z hlavních problémů s používáním Turingova testu k hodnocení strojové inteligence to, že téměř zcela zanedbává schopnost strojů vyhledávat informace a provádět bleskově rychlé výpočty. Programy umělé inteligence vkládají umělé pauzy do odpovědí na složité matematické a geografické otázky, aby oklamaly lidi, ale mají odpověď na takové otázky téměř okamžitě. Kromě toho Turingův test nezohledňuje rostoucí schopnost umělé inteligence používat data shromážděná vnějšími senzory, ignoruje, jak umělé inteligence mohou interagovat se světem kolem nich prostřednictvím vizuálních a pohybových algoritmů, spoléhajících se pouze na textovou komunikaci.

Vytvoření nových měřítek

Prasad argumentoval, že by měly být vytvořeny nové formy měření inteligence, metody, které jsou lépe přizpůsobeny k hodnocení obecného typu inteligence. Tyto testy by měly odrážet, jak je umělá inteligence skutečně používána v moderní společnosti a cíle lidí pro její použití. Testy by měly být schopny určit, jak dobře umělá inteligence zvyšuje lidskou inteligenci a jak dobře zlepšuje životy lidí. Kromě toho by měl test rozumět, jak umělá inteligence projevuje lidské rysy inteligence, včetně jazykové zdatnosti, sebeřízení a „zdravého rozumu“.

Aktuální a důležité oblasti výzkumu umělé inteligence, jako je uvažování, spravedlnost, konverzace a smyslové pochopení, nejsou hodnoceny Turingovým testem, ale mohou být měřeny mnoha způsoby. Prasad vysvětlil, že jedním ze způsobů měření těchto rysů inteligence je rozdělení výzev na jednotlivé úkoly. Další metodou pro hodnocení je vytvoření velké, reálné výzvy pro interakci mezi člověkem a počítačem.

Když Amazon (AMZN ) vytvořil Alexa Prize, vytvořil rubriku, která vyžadovala, aby sociální boti mluvili s člověkem po dobu 20 minut. Boti by byli hodnoceni podle své schopnosti konverzovat koherentně na širokou škálu témat, jako je technologie, sport, politika a zábava. Zákazníci byli zodpovědní za hodnocení botů během fáze vývoje, přiřazovali jim body na základě své touhy mluvit s botem znovu. Během finální kola byli nezávislí soudci zodpovědní za hodnocení botů pomocí 5bodové škály. Rubrika používaná soudci spoléhala na metody, které umožňovaly umělé inteligenci projevit důležité lidské atributy, jako je empatie, kde bylo vhodné.

Nakonec Prasad argumentoval, že rostoucí proliferace zařízení s umělou inteligencí, jako je Alexa, představuje důležitou příležitost k měření pokroku umělé inteligence, ale budeme potřebovat jiná měřítka, abychom mohli využít této nové příležitosti.

„Takoví umělá inteligence potřebují být odborníky na velký, stále rostoucí počet úkolů, což je možné pouze s více obecnou učební schopností místo specifické inteligence,“ vysvětlil Prasad. „Proto, pro příští dekádu a dále, užitelnost služeb umělé inteligence, s jejich konverzačními a proaktivními pomocnými schopnostmi na ambientních zařízeních, jsou hodná zkouška.”

Blogger a programátor se specializací na Machine Learning a Deep Learning témata. Daniel doufá, že pomůže ostatním využít sílu AI pro sociální dobro.