Mô hình và nền tảng AI
Công Nghệ Nhận Dạng Khuôn Mặt AI Mới Đi Một Bước Tiến
Có vẻ như việc sử dụng trí tuệ nhân tạo trong công nghệ nhận dạng khuôn mặt là một trong những lĩnh vực đã phát triển mạnh mẽ nhất cho đến nay. Theo ZDNet, cho đến nay, các công ty như Microsoft (MSFT ) đã phát triển công nghệ nhận dạng khuôn mặt có thể nhận ra biểu cảm khuôn mặt (FR) bằng cách sử dụng các công cụ cảm xúc. Nhưng yếu tố hạn chế cho đến nay là những công cụ này chỉ giới hạn ở tám trạng thái cốt lõi – tức là giận dữ, khinh thường, sợ hãi, ghê tởm, hạnh phúc, buồn, ngạc nhiên hoặc trung lập.
Giờ đây, nhà phát triển công nghệ Nhật Bản Fujitsu đã bước vào với công nghệ dựa trên AI giúp nhận dạng khuôn mặt đi một bước tiến trong việc theo dõi cảm xúc được thể hiện.
Công nghệ FR hiện tại dựa trên việc “xác định các đơn vị hành động (AUs) khác nhau – tức là các chuyển động cơ khuôn mặt mà chúng ta thực hiện và có thể liên kết với các cảm xúc cụ thể.” Trong một ví dụ cụ thể, “nếu cả AU ‘nâng má’ và AU ‘kéo góc miệng’ được xác định cùng nhau, AI có thể kết luận rằng người được phân tích đang hạnh phúc.
Theo lời của một phát ngôn viên Fujitsu, “vấn đề với công nghệ hiện tại là AI cần được đào tạo trên các tập dữ liệu lớn cho mỗi AU. Nó cần biết cách nhận ra một AU từ tất cả các góc và vị trí có thể. Nhưng chúng tôi không có đủ hình ảnh cho việc đó – vì vậy, thông thường, nó không chính xác.”
Một lượng lớn dữ liệu cần thiết để đào tạo AI hiệu quả trong việc phát hiện cảm xúc, thật khó cho công nghệ FR hiện tại thực sự nhận ra cảm xúc của người được kiểm tra. Và nếu người đó không ngồi trước máy ảnh và nhìn thẳng vào nó, nhiệm vụ trở nên thậm chí còn khó hơn. Nhiều chuyên gia đã xác nhận những vấn đề này trong một số nghiên cứu gần đây.
Fujitsu tuyên bố đã tìm ra giải pháp để tăng chất lượng kết quả nhận dạng khuôn mặt trong việc phát hiện cảm xúc. Thay vì sử dụng một số lượng lớn hình ảnh để đào tạo AI, công cụ mới được tạo ra có nhiệm vụ “trích xuất nhiều dữ liệu hơn từ một bức ảnh.” Công ty gọi quá trình này là ‘quá trình chuẩn hóa’, liên quan đến việc chuyển đổi hình ảnh “được chụp từ một góc cụ thể thành hình ảnh giống như một bức ảnh chụp thẳng.”
Theo lời của phát ngôn viên, “với cùng một tập dữ liệu hạn chế, chúng tôi có thể phát hiện nhiều AU hơn, thậm chí trong hình ảnh chụp từ góc nghiêng, và với nhiều AU hơn, chúng tôi có thể xác định cảm xúc phức tạp, tinh vi hơn so với các biểu cảm cốt lõi hiện được phân tích.”
Công ty tuyên bố rằng bây giờ họ có thể “phát hiện thay đổi cảm xúc tinh vi như tiếng cười lo lắng, với tỷ lệ phát hiện chính xác là 81%, một con số được xác định thông qua ‘phương pháp đánh giá tiêu chuẩn’.” So sánh, theo nghiên cứu độc lập, các công cụ của Microsoft có tỷ lệ chính xác là 60%, và cũng gặp vấn đề khi phát hiện cảm xúc khi làm việc với hình ảnh chụp từ góc nghiêng.
Về các ứng dụng tiềm năng, Fujitsu đề cập rằng các công cụ mới của họ có thể được sử dụng, trong số những thứ khác, để đảm bảo an toàn giao thông “bằng cách phát hiện thậm chí những thay đổi nhỏ trong sự tập trung của lái xe.”












