로보틱스 및 피지컬 AI
인간은 인간과 같은 로봇과 상호작용하기를 선호한다, 연구 결과
도쿄 공과 대학과 리켄의 연구자들은 다양한 기계의 음성에 대한 우리의 인식과 상호작용에 대한 새로운 통찰력을 얻었습니다. 연구 팀은 메타 합성을 수행했으며, 그들의 결과는 인간의 선호도에 대한 새로운 정보를 제공하며, 이는 엔지니어와 디자이너가 미래의 음성 기술을 개발하는 데 사용할 수 있습니다.
인간은 주로 음성과 청각을 통해 모든 것을 전달하며, 언어 정보에서 감정 상태와 성격까지 전달합니다. 우리의 음성은 음调, 리듬, 피치에 크게 의존합니다.
다양한 분야를 결합하여 프레임워크를 생성
우리의 상호작용은 현재 컴퓨터 에이전트, 인터페이스, 환경으로 확장되고 있으며, 이는 AI 기술의 발전에 따른 것입니다. 연구는 인간-에이전트 상호작용(HAI), 인간-로봇 상호작용(HRI), 인간-컴퓨터 상호작용(HCI), 인간-기계 커뮤니케이션(HMC) 분야에서 수행됩니다.
연구 팀은 여러 연구의 결과를 비교하여 컴퓨터 음성에 대한 미래의 설계와 연구를 위한 프레임워크를 생성하려고 했습니다.
도쿄 공과 대학의 케이티 시ーボ恩(Katie Seaborn) 부교수는 연구를 주도했습니다.
“음성 조수, 스마트 스피커, 우리에게 말할 수 있는 차량, 사회 로봇이 이미 여기 있습니다. 이러한 기술을 어떻게 설계하여 우리와 함께 일하고, 우리와 함께 살며, 우리의需求과 바람을满足하는지 알아야 합니다. 또한 이러한 기술이 우리의 태도와 행동, 특히 미묘하고 보이지 않는 방식으로 어떻게 영향을 미치는지 알아야 합니다.” 시ーボ恩 교수는 말합니다.
연구 팀의 설문조사는 에이전트 음성에 대한 사용자 인식에 초점을 둔 동료 검토 저널 논문과 회의 논문에 대한 조사였습니다. 출처 자료에는 다양한 에이전트, 인터페이스, 환경 유형 및 기술이 포함되었으며, 대부분은 “몸이 없는” 컴퓨터 음성, 컴퓨터 에이전트, 사회 로봇이었습니다.
대부분의 사용자는 대학 학생과 성인으로, 연구자들은 상호작용 맥락에서 에이전트 음성에 대한 인식에 대한 패턴을 관찰하고 매핑한 후 결론을 내릴 수 있었습니다.
연구 팀의 발견
연구의 결과는 사용자가 상호작용하는 에이전트를 인간화했으며, 그들이 자신의 성격과 말하는 스타일과 유사한 것과 상호작용하는 것을 선호한다는 것을 보여주었습니다. 연구는 또한 인간의 음성이 합성된 음성보다 선호되었으며, 음성 필러를 추가하면 상호작용이 개선된다는 것을 보여주었습니다.
설문조사에 따르면, 개인은 인간과 같은, 행복한, 공감하는 목소리와 더 높은 피치를 가진 목소리를 선호했습니다. 그러나 일부 사용자 선호도는 시간이 지남에 따라 변경되었습니다. 예를 들어, 음성 성별에 대한 사용자 선호도는 남성 음성에서 여성 음성으로 변경되었습니다.
연구자들은 이러한 결과를 바탕으로 컴퓨터 기반 기술을 분류하기 위한 높은 수준의 프레임워크를 생성했습니다.
또 다른 발견은 사용자가 에이전트를 더 잘 인식할 수 있었으며, 에이전트의 음성이 에이전트의 몸과 “일치”하는 경우였습니다.
연구 팀의 설문조사는 음성 기반 인간-에이전트 상호작용(vHAI)의 새로운 및 기존 기술을 생성하는 데 사용될 수 있습니다.
“이 연구에서 나타난 연구 계획은 음성 기반 에이전트, 인터페이스, 시스템, 공간, 경험을 개발하고 연구하는 방식을 향후 안내할 것으로 예상됩니다.” 시ーボ恩 교수는 말합니다.












