Робототехніка та фізичний ШІ

Люди віддають перевагу взаємодії з роботами, схожими на людей, дослідження показало

mm
Додайте Unite.AI до бажаних джерел у Google

Дослідники з Токійського технологічного інституту та Riken, Японія, отримали нові знання про те, як ми сприймаємо та взаємодіємо з голосом різних машин. Команда провела мета-синтез, і їхні результати надають нову інформацію про людські уподобання, яку інженери та дизайнери можуть використовувати для розробки майбутніх голосових технологій.

Люди в основному спілкуються голосом і слухом, передавая все від лінгвістичних відомостей до емоційних станів і особистостей. Сприйняття нашого голосу сильно залежить від тона, ритму та висоти.

Об’єднання різних галузей для створення рамок

Наша взаємодія тепер розширюється на комп’ютерні агенти, інтерфейси та середовища завдяки вдосконаленням у сфері штучного інтелекту. Дослідження часто проводяться в галузях взаємодії людини з агентом (HAI), взаємодії людини з роботом (HRI), взаємодії людини з комп’ютером (HCI) та спілкування людини з машиною (HMC).

Команда дослідників намагалася порівняти результати кількох досліджень у різних галузях, намагаючись створити рамки для майбутнього дизайну та дослідження комп’ютерного голосу.

Асистент-професор Кеті Сіборн з Токійського технологічного інституту був головним дослідником.

“Голосові помічники, розумні динаміки, транспортні засоби, які можуть говорити з нами, та соціальні роботи вже тут”, каже проф. Сіборн. ”Нам потрібно знати, як найкраще розробити ці технології, щоб вони працювали з нами, жили з нами та відповідали нашим потребам і бажанням. Нам також потрібно знати, як вони вплинули на наші ставлення та поведінку, особливо в тонких і невидимих способах.”

Опитування команди розглядало рецензовані статті в журналах та матеріали конференцій, що базуються на опитуваннях, з акцентом на сприйнятті голосу агента користувачами. Джерельні матеріали включали різноманітні типи агентів, інтерфейсів та середовищ і технологій, причому більшість з них були “безтілесними” комп’ютерними голосами, комп’ютерними агентами та соціальними роботами.

Більшість користувачів були університетськими студентами та дорослими, і дослідники змогли спостерігати та картографувати закономірності перед тим, як зробити висновки про сприйняття голосу агента в різних контекстах взаємодії.

Результати команди

Результати дослідження показали, що користувачі антропоморфізували агентів, з якими вони взаємодіяли, і віддавали перевагу взаємодії з тими, хто був схожий на їхню особистість та стиль мови. Дослідження також показало, що людські голоси були віддані перевагу перед синтетickými, і взаємодія покращувалася додаванням голосових заповнювачів.

Згідно з опитуванням, люди віддавали перевагу голосам, схожим на людські, щасливим, емпатичним голосам з вищими висотами. Однак деякі уподобання користувачів змінювалися з часом. Наприклад, уподобання щодо статі голосу змінилося від чоловічих голосів до жіночих.

Дослідники взяли ці результати та створили високорівневу рамку для класифікації різних типів взаємодій у комп’ютерних технологіях.

Іншим висновком було те, що користувачі часто сприймали агентів краще, коли агенти мали тіло, з голосом, який “відповідав” тілу агента.

Опитування команди можна використовувати для створення нових та існуючих технологій у сфері голосової взаємодії людини з агентом (vHAI).

“Дослідницька програма, яка виникла в результаті цієї роботи, як очікується, покаже, як розробляти та вивчати голосові агенти, інтерфейси, системи, простори та досвід у майбутньому”, каже проф. Сіборн.

Алекс Макфарленд - журналіст та письменник з питань штучного інтелекту, який досліджує останні розробки в галузі штучного інтелекту. Він співпрацював з численними стартапами та виданнями з штучного інтелекту у світі.