Robot học và AI vật lý

Con người ưa thích tương tác với rô-bốt giống con người, nghiên cứu phát hiện

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Các nhà nghiên cứu tại Viện Công nghệ Tokyo và Riken, Nhật Bản, đã có được cái nhìn sâu sắc mới về cách chúng ta nhận thức và tương tác với giọng nói của các máy móc khác nhau. Đội nghiên cứu đã thực hiện một phân tích tổng hợp, và phát hiện của họ cung cấp thông tin mới về sở thích của con người, mà các kỹ sư và nhà thiết kế có thể sử dụng để phát triển các công nghệ giọng nói trong tương lai.

Con người chủ yếu giao tiếp bằng giọng nói và thính giác, truyền tải mọi thứ từ thông tin ngôn ngữ đến trạng thái cảm xúc và tính cách. Sự nhận thức về giọng nói của chúng ta phụ thuộc rất nhiều vào âm điệu, nhịp điệu và cao độ.

Kết hợp các lĩnh vực khác nhau để tạo khuôn khổ

Các tương tác của chúng ta hiện đang mở rộng sang các đại lý máy tính, giao diện và môi trường do sự tiến bộ của công nghệ trí tuệ nhân tạo. Nghiên cứu thường diễn ra trong các lĩnh vực tương tác giữa con người và đại lý (HAI), tương tác giữa con người và rô-bốt (HRI), tương tác giữa con người và máy tính (HCI) và giao tiếp giữa con người và máy móc (HMC).

Đội nghiên cứu đã tìm cách so sánh các phát hiện từ một số nghiên cứu trong các lĩnh vực khác nhau, nhằm tạo ra một khuôn khổ để hướng dẫn thiết kế và nghiên cứu về giọng nói máy tính trong tương lai.

Giáo sư Katie Seaborn từ Tokyo Tech là nhà nghiên cứu đứng đầu.

“Trợ lý giọng nói, loa thông minh, xe ô tô có thể nói chuyện với chúng ta và rô-bốt xã hội đã ở đây,” Giáo sư Seaborn nói. ”Chúng ta cần biết cách thiết kế những công nghệ này để làm việc với chúng ta, sống cùng chúng ta và đáp ứng nhu cầu và mong muốn của chúng ta. Chúng ta cũng cần biết cách chúng đã ảnh hưởng đến thái độ và hành vi của chúng ta, đặc biệt là trong những cách tinh tế và không nhìn thấy được.”

Khảo sát của đội nghiên cứu đã xem xét các bài báo và hồ sơ hội nghị dựa trên các nghiên cứu về nhận thức của người dùng về giọng nói của đại lý. Các tài liệu nguồn bao gồm nhiều loại đại lý, giao diện và môi trường khác nhau, với hầu hết là giọng nói máy tính “không có thân thể” và rô-bốt xã hội.

Hầu hết người dùng là sinh viên đại học và người lớn, và các nhà nghiên cứu đã có thể quan sát và lập bản đồ các mẫu trước khi rút ra kết luận về nhận thức về giọng nói của đại lý trong nhiều ngữ cảnh tương tác.

Phát hiện của đội nghiên cứu

Kết quả của nghiên cứu cho thấy người dùng đã nhân cách hóa các đại lý mà họ tương tác, và họ thích tương tác với những đại lý giống với tính cách và phong cách nói chuyện của họ. Nghiên cứu cũng cho thấy giọng nói của con người được ưa thích hơn giọng nói tổng hợp, và tương tác được cải thiện bằng cách thêm các yếu tố lấp đầy giọng nói.

Theo khảo sát, các cá nhân thích giọng nói giống con người, hạnh phúc, đồng cảm với cao độ cao hơn. Tuy nhiên, một số sở thích của người dùng đã thay đổi theo thời gian. Ví dụ, sở thích về giới tính giọng nói đã thay đổi từ giọng nói nam sang giọng nói nữ.

Các nhà nghiên cứu đã đưa những phát hiện này và tạo ra một khuôn khổ cấp cao để phân loại các loại tương tác khác nhau trên các công nghệ dựa trên máy tính.

Một phát hiện khác là người dùng thường nhận thức về các đại lý tốt hơn khi các đại lý được nhân cách hóa, với giọng nói “khớp” với thân thể của đại lý.

Khảo sát của đội nghiên cứu có thể được sử dụng cho việc tạo ra các công nghệ mới và hiện có trong tương tác giữa con người và đại lý dựa trên giọng nói (vHAI).

“Chương trình nghiên cứu mà chúng tôi đã tạo ra từ công việc này dự kiến sẽ hướng dẫn cách các đại lý dựa trên giọng nói, giao diện, hệ thống, không gian và trải nghiệm được phát triển và nghiên cứu trong những năm tới,” Giáo sư Seaborn nói.

Alex McFarland là một nhà báo và nhà văn về trí tuệ nhân tạo, khám phá những phát triển mới nhất trong lĩnh vực trí tuệ nhân tạo. Ông đã hợp tác với nhiều công ty khởi nghiệp và xuất bản về trí tuệ nhân tạo trên toàn thế giới.