Mô hình và nền tảng AI

Kỹ Thuật Thị Giác Máy Tính Dự Đoán Hành Vi Con Người Từ Video

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Một kỹ thuật thị giác máy tính mới được các nhà nghiên cứu tại Columbia Engineering phát triển có thể dự đoán hành vi con người từ video. Kỹ thuật mới này cho phép máy móc có được trực giác để dự đoán những gì sẽ xảy ra tiếp theo bằng cách sử dụng các liên kết cấp cao giữa người, động vật và vật thể.

Carl Vondrick là giáo sư trợ lý về khoa học máy tính tại Columbia. Vondrick đã chỉ đạo nghiên cứu, được trình bày vào ngày 24 tháng 6 tại Hội nghị Quốc tế về Thị giác Máy tính và Nhận dạng Mẫu.

“Thuật toán của chúng tôi là một bước tiến trong việc cho phép máy móc đưa ra dự đoán tốt hơn về hành vi con người và do đó có thể phối hợp hành động của chúng với chúng ta tốt hơn,” Vondrick nói. “Kết quả của chúng tôi mở ra nhiều khả năng cho sự hợp tác giữa con người và robot, phương tiện tự động và công nghệ hỗ trợ.”

Phương pháp mới này là phương pháp chính xác nhất trong loại của nó cho đến nay để dự đoán các sự kiện hành động video trong vài phút tới. Hệ thống đầu tiên đã phân tích hàng nghìn giờ phim, trò chơi và chương trình trước khi dự đoán hàng trăm hoạt động, chẳng hạn như bắt tay và đấm bốc.

Nếu hệ thống không thể dự đoán một hành động cụ thể, nó sẽ tìm một khái niệm cấp cao hơn liên kết chúng, chẳng hạn như từ “lời chào.”

Các Nỗ Lực Trong Quá Khứ

Các nỗ lực trước đây trong việc học máy dự đoán thường tập trung vào việc dự đoán một hành động tại một thời điểm, với các thuật toán quyết định phân loại hành động, chẳng hạn như một cái ôm, một cái bắt tay, một cái vỗ tay hoặc không hành động. Tuy nhiên, sự không chắc chắn cao có nghĩa là hầu hết các mô hình học máy không thể tìm thấy sự tương đồng giữa các lựa chọn có thể.

Đội ngũ bao gồm các sinh viên tiến sĩ tại Columbia Engineering Didac Suris và Ruoshi Liu, và họ đã xem xét vấn đề dự đoán dài hạn một cách khác biệt.

Suris là đồng tác giả chính của bài báo.

“Không phải mọi thứ trong tương lai đều có thể dự đoán được,” Suris nói. “Khi một người không thể dự đoán chính xác những gì sẽ xảy ra, họ sẽ chơi an toàn và dự đoán ở mức độ trừu tượng cao hơn. Thuật toán của chúng tôi là thuật toán đầu tiên học được khả năng lý luận trừu tượng về các sự kiện trong tương lai.”

https://www.youtube.com/watch?v=b1riFCPiqN4

Phát Triển Hệ Thống Mới

Suris và Liu đã dựa vào các hình học không thường xuyên để phát triển các mô hình AI tổ chức các khái niệm cấp cao và dự đoán hành vi con người trong tương lai.

Aude Oliva, người không tham gia vào nghiên cứu, là nhà khoa học nghiên cứu cấp cao tại Viện Công nghệ Massachusetts và đồng giám đốc của Phòng thí nghiệm Trí tuệ Nhân tạo Watson MIT-IBM.

“Dự đoán là cơ sở của trí tuệ con người,” Oliva nói. “Máy móc mắc lỗi mà con người không bao giờ làm vì chúng thiếu khả năng lý luận trừu tượng. Công việc này là một bước quan trọng trong việc bắc cầu khoảng cách công nghệ này.”

Các nhà nghiên cứu đã phát triển một khuôn khổ toán học cho phép máy móc tổ chức các sự kiện theo mức độ dự đoán của chúng trong tương lai. Ví dụ, hệ thống mới học cách phân loại các hoạt động như bơi lội và chạy bộ như các hoạt động riêng biệt, thay vì chỉ tập thể dục. Hệ thống cũng có thể tính đến sự không chắc chắn, dẫn đến các hành động cụ thể hơn.

Theo Liu, đồng tác giả của bài báo, kỹ thuật mới này có thể giúp máy tính đưa ra quyết định tinh vi hơn thay vì các hành động được lập trình trước, và nó rất quan trọng để xây dựng niềm tin giữa con người và máy tính.

“Sự tin tưởng đến từ cảm giác rằng robot thực sự hiểu con người,” anh giải thích. “Nếu máy móc có thể hiểu và dự đoán hành vi của chúng ta, máy tính sẽ có thể hỗ trợ con người một cách mượt mà trong các hoạt động hàng ngày.”

Đội ngũ sẽ tiếp tục xác minh kỹ thuật này hoạt động trong thế giới thực, và nó có thể được triển khai cho an toàn, sức khỏe và bảo mật.

“Hành vi con người thường gây ngạc nhiên,” Vondrick nói. “Thuật toán của chúng tôi cho phép máy móc dự đoán tốt hơn những gì chúng sẽ làm tiếp theo.”

Alex McFarland là một nhà báo và nhà văn về trí tuệ nhân tạo, khám phá những phát triển mới nhất trong lĩnh vực trí tuệ nhân tạo. Ông đã hợp tác với nhiều công ty khởi nghiệp và xuất bản về trí tuệ nhân tạo trên toàn thế giới.