Mô hình và nền tảng AI

Facebook Tạo Ra Trợ Lý Trò Chuyện Mở Phạm Vi Tự Nhiên Được Đào Tạo Trên 1,5 Tỷ Bài Đăng Reddit

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Facebook (META ) vừa mới ra mắt một trợ lý trò chuyện mở phạm vi có tên gọi là “Blender”. Theo báo cáo của BBC, Blender của Facebook là trợ lý trò chuyện mở phạm vi lớn nhất từ trước đến nay của công ty và theo công ty, nó có thể thể hiện sự đồng cảm, tính cách và kiến thức, vượt trội và cảm giác giống con người hơn so với các trợ lý trò chuyện khác. Blender có sẵn để sử dụng trong ba biến thể khác nhau, mỗi biến thể có mức độ phức tạp và tính tinh vi của mô hình khác nhau. Có một mô hình thần kinh 90 triệu tham số, một mô hình 2,7 tỷ tham số và một mô hình 9,4 tỷ tham số. Mô hình 9,4 tỷ tham số lớn hơn khoảng 3,6 lần so với trợ lý trò chuyện hiện có lớn nhất.

Facebook tuyên bố rằng Blender là trợ lý trò chuyện mở phạm vi đầu tiên có sẵn rộng rãi kết hợp một tập hợp phức tạp và đa dạng các kỹ năng trò chuyện như kiến thức và đồng cảm. Trợ lý trò chuyện Blender có thể thảo luận về nhiều chủ đề và duy trì một cuộc trò chuyện lên đến 14 “lượt” trò chuyện. Theo báo cáo, khoảng 49% người tương tác với trợ lý trò chuyện thích tương tác với bot hơn là với một người khác.

Blender được đào tạo bằng dữ liệu thu thập từ các cuộc trò chuyện thuộc phạm vi công cộng thu thập từ các trang web truyền thông xã hội như Reddit. Tập dữ liệu được sử dụng để đào tạo Blender bao gồm khoảng 1,5 tỷ ví dụ về các cuộc trò chuyện. Mặc dù dữ liệu đào tạo và tính tinh vi của mô hình cho phép trợ lý trò chuyện thực hiện các cuộc thảo luận phức tạp và có cảm giác tự nhiên, giống con người hơn, nhưng vẫn có một số vấn đề xuất hiện do kỹ thuật đào tạo này. Theo các nhà nghiên cứu, Blender đôi khi phản hồi các lời nhắc trò chuyện một cách hung hăng hoặc bằng ngôn ngữ xúc phạm. Ngoài ra, trợ lý trò chuyện đôi khi phản hồi bằng những lời nói dối và sự kiện bịa đặt. Đội ngũ nghiên cứu lạc quan rằng các bản sửa đổi của mô hình sẽ giải quyết những vấn đề này, nhưng họ muốn phát hành mô hình dù sao.

Theo một phát ngôn viên của Facebook, được trích dẫn bởi BBC, “việc phát hành mô hình là điều cần thiết để cho phép có những hiểu biết đầy đủ và đáng tin cậy về khả năng của chúng.”

Các nhà nghiên cứu của Facebook vẫn cần phải vượt qua hai thách thức lớn để thành công, theo Dave Choplin, giám đốc điều hành của công ty tư vấn trí tuệ nhân tạo The Envisioners. Theo Choplin, được trích dẫn bởi BBC, các nhà nghiên cứu sẽ phải đối mặt với những thách thức lớn trong việc sao chép nhiều sắc thái của các cuộc trò chuyện mà con người thường coi là đương nhiên và dữ liệu được sử dụng để đào tạo mô hình có thể sẽ cản trở nó theo những cách mà các nhà nghiên cứu của Facebook có thể sẽ gặp khó khăn để vượt qua.

“Như một nền tảng tuyệt vời như Reddit, việc đào tạo các thuật toán dựa trên các cuộc trò chuyện bạn tìm thấy ở đó sẽ mang lại cho bạn rất nhiều ‘lúa mì’ lẫn ‘lúa mạch’,” Choplin nói.

Facebook đã so sánh trợ lý trò chuyện Blender của mình với trợ lý trò chuyện Meena của Google. Bài đăng trên blog của Facebook hiển thị các so sánh giữa Meena và Blender, và theo dữ liệu của Facebook, khoảng 75% người trả lời đã tham gia vào một cuộc trò chuyện với Blender cho biết họ sẽ thích tham gia vào một cuộc thảo luận dài hơn với Blender hơn là Meena. Ngoài ra, khoảng 67% người trả lời cho biết Blender tự nhiên và giống con người hơn Meena khi nói đến các cuộc trò chuyện dài.

Trong tương lai, đội ngũ nghiên cứu của Facebook muốn cải thiện khả năng trò chuyện của các mô hình, thiết kế các mô hình có thể hỗ trợ các cuộc trò chuyện dài hơn với sự trợ giúp của các hàm mất mát mới và kiến trúc. Ngoài ra, các nhà nghiên cứu đang nhằm mục đích giải quyết sự thiên vị về giới tính và ngôn ngữ có hại tiềm tàng bằng cách xây dựng các phân loại器 tốt hơn và dữ liệu đào tạo đại diện hơn.

Blogger và lập trình viên với chuyên môn về Machine Learning Deep Learning topics. Daniel hy vọng giúp đỡ người khác sử dụng sức mạnh của AI cho lợi ích xã hội.