Robotyka i fizyczna AI

Ludzie wolą wchodzić w interakcje z robotami podobnymi do ludzi, wynika z badań

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Naukowcy z Tokijskiego Instytutu Technologicznego i Riken w Japonii uzyskali nowe spojrzenie na to, jak postrzegamy i wchodzimy w interakcje z głosem różnych maszyn. Zespół przeprowadził meta-syntezę, a ich wyniki dostarczają nowych informacji o ludzkich preferencjach, które inżynierowie i projektanci mogą wykorzystać do rozwoju przyszłych technologii głosowych.

Ludzie przede wszystkim komunikują się głosowo i słuchowo, przekazując wszystko od informacji językowych po stany emocjonalne i osobowości. Postrzeganie naszego głosu w dużej mierze zależy od tonu, rytmu i wysokości.

Łączenie różnych dziedzin w celu stworzenia ramy

Nasze interakcje obecnie rozszerzają się na agenci komputerowe, interfejsy i środowiska dzięki postępom w technologiach sztucznej inteligencji. Badania często prowadzone są w dziedzinach interakcji człowiek-agenci (HAI), interakcji człowiek-robot (HRI), interakcji człowiek-komputer (HCI) i komunikacji człowiek-maszyna (HMC).

Zespół naukowców starał się porównać wyniki z kilku badań w różnych dziedzinach, starając się stworzyć ramy, które będą przewodnikiem dla przyszłego projektowania i badań nad głosem komputerowym.

Kierownikiem zespołu badawczego była associate Professor Katie Seaborn z Tokijskiego Instytutu Technologicznego.

“Asystenci głosowi, głośniki inteligentne, pojazdy, które mogą z nami rozmawiać, i roboty społeczne już istnieją”, mówi Prof. Seaborn. ”Musimy wiedzieć, jak najlepiej zaprojektować te technologie, aby współpracowały z nami, aby żyły z nami i spełniały nasze potrzeby i pragnienia. Musimy również wiedzieć, jak wpłynęły one na nasze postawy i zachowania, szczególnie w subtelnych i niewidocznych sposób”.

Badanie zespołu obejmowało artykuły z recenzowanego czasopisma i materiały konferencyjne ze szczególnym uwzględnieniem postrzegania głosu agenta przez użytkownika. Materiały źródłowe obejmowały różne typy agentów, interfejsów i środowisk oraz technologie, przy czym większość z nich była „bezcielesnymi” głosami komputerowymi, agentami komputerowymi i robotami społecznymi.

Większość użytkowników stanowili studenci i dorośli, a naukowcom udało się zaobserwować i nanosić wzorce przed wyciągnięciem wniosków na temat postrzegania głosu agenta w różnych kontekstach interakcji.

Wyniki zespołu

Wyniki badania wykazały, że użytkownicy antropomorfizowali agenci, z którymi wchodzili w interakcje, i preferowali interakcje z tymi, które były podobne do ich osobowości i stylu mówienia. Badanie wykazało również, że głosy ludzkie były preferowane nad syntetycznymi, a interakcja była poprawiona przez dodanie wypełniaczy głosowych.

Zgodnie z badaniem, osoby preferowały głosy ludzkie, szczęśliwe, empatyczne z wyższymi tonami. Jednak niektóre z preferencji użytkowników zmieniały się z czasem. Na przykład preferencja dla płci głosu zmieniła się z męskich głosów na głosy kobiece.

Naukowcy wzięli te wyniki i stworzyli ramy wysokiego poziomu, aby sklasyfikować różne typy interakcji w technologiach komputerowych.

Innym odkryciem było to, że użytkownicy często postrzegali agenci lepiej, gdy agenci byli ucieleśnieni, a głos „pasował” do ciała agenci.

Badanie zespołu mogłoby być wykorzystane do stworzenia nowych i istniejących technologii w interakcji człowiek-agenci opartej na głosie (vHAI).

“Agenda badawcza, która wynikła z tej pracy, ma przewodniczyć temu, jak agenci oparte na głosie, interfejsy, systemy, przestrzenie i doświadczenia będą rozwijane i badane w nadchodzących latach”, mówi Prof. Seaborn.

Alex McFarland jest dziennikarzem i pisarzem zajmującym się sztuczną inteligencją, który bada najnowsze rozwoje w dziedzinie sztucznej inteligencji. Współpracował z licznymi startupami i wydawnictwami związanymi z sztuczną inteligencją na całym świecie.