Mô hình và nền tảng AI
Máy tính có thể xác định 200 loài chim từ một bức ảnh
Các nhà nghiên cứu từ Đại học Duke đã sử dụng học máy để đào tạo một máy tính có thể xác định lên đến 200 loài chim khác nhau. Máy tính chỉ cần một bức ảnh để hoàn thành quá trình xác định. Đối với con người, việc xác định các loài chim khác nhau thường đòi hỏi nhiều năm quan sát chim.
Nghiên cứu được dẫn dắt bởi sinh viên tiến sĩ khoa học máy tính Chaofan Chen của Đại học Duke, cùng với sinh viên đại học Oscar Li. Dự án cũng được thực hiện bởi các thành viên khác của Phòng thí nghiệm Phân tích Dự đoán do giáo sư Cynthia Rudin của Đại học Duke chỉ đạo.
A.I. Hiện Thị Sự Tư Duy
Mặc dù quá trình xác định là ấn tượng, nhưng có một khía cạnh quan trọng hơn của sự phát triển này. Trí tuệ nhân tạo (A.I.) có thể hiện thị sự tư duy của nó, cho phép даже những người quan sát chim không chuyên cũng có thể hiểu được quá trình.
Mạng lưới thần kinh sâu, hoặc các thuật toán dựa trên hoạt động của não bộ, đã được đào tạo với 11.788 bức ảnh. Các bức ảnh bao gồm 200 loài chim khác nhau, từ vịt đến chim ruồi.
Đội ngũ nghiên cứu không cần phải đào tạo cụ thể mạng lưới để xác định mỏ hoặc lông cánh. Thay vào đó, mạng lưới có thể lấy một bức ảnh của chim và xác định các mẫu trong hình ảnh. Sau đó, nó có thể lấy những mẫu đó và xác định các mẫu trước đó mà nó đã gặp trong các đặc điểm loài điển hình.
Theo đội ngũ, mạng lưới sau đó tạo ra một loạt các bản đồ nhiệt để xác định các đặc điểm. Ví dụ, nó có thể phân biệt giữa một loài chim warbler thông thường và một loài chim warbler có mũ, cùng với các đặc điểm khác như đầu có mũ và bụng vàng. Sau đó, nó chỉ ra rằng những đặc điểm này là gì đã dẫn đến việc xác định.
Khác Biệt So Với Các Hệ Thống Khác
Mạng lưới thần kinh đã có thể xác định loài chim chính xác lên đến 84% thời gian. Điều này tương tự như một số hệ thống hoạt động tốt nhất. Sự khác biệt là những hệ thống đó không giải thích quá trình tư duy như hệ thống này.
Theo Rudin, khía cạnh cách mạng nhất của dự án này là nó cung cấp hình ảnh hóa cho những gì các mạng lưới thần kinh sâu nhìn thấy khi chúng nhìn vào một hình ảnh.
Công nghệ này cũng đang được sử dụng trên các trang mạng xã hội, để xác định các tội phạm nghi ngờ trong camera giám sát, và giúp các phương tiện tự động xác định đèn giao thông và người đi bộ.
Phần mềm học sâu thường không cần phải được lập trình rõ ràng để học từ dữ liệu, điều này không giống như phần mềm truyền thống. Tuy nhiên, quá trình này không luôn rõ ràng hoặc được hiển thị, vì vậy thường khó giải thích làm thế nào các thuật toán “tư duy” khi phân loại một hình ảnh.
Trong Tương Lai
Rudin và các đồng nghiệp đang làm việc trên các mô hình học sâu mới cho A.I., đẩy lĩnh vực này tiến về phía trước. Các mô hình mới có thể giải thích lý do và quá trình xác định của chúng. Điều này giúp các nhà nghiên cứu nhìn thấy từ đầu đến cuối, và nó làm cho việc xác định lý do đằng sau một sai lầm hoặc vấn đề trở nên dễ dàng hơn.
Rudin và đội ngũ của cô sẽ làm việc trên việc sử dụng thuật toán trong lĩnh vực y tế. Nó có thể xác định các khu vực vấn đề trong các hình ảnh y tế như chụp X-quang vú. Điều này sẽ giúp các chuyên gia y tế phát hiện các cục u, vôi hóa, và các dấu hiệu khác của ung thư vú.
Theo Rudin, mạng lưới mô phỏng cách các bác sĩ chẩn đoán.
“Đó là lý do dựa trên trường hợp,” Rudin nói. “Chúng tôi hy vọng chúng tôi có thể giải thích rõ hơn cho các bác sĩ hoặc bệnh nhân tại sao hình ảnh của họ được phân loại bởi mạng lưới là ác tính hoặc lành tính.”
Đội ngũ sẽ trình bày một bài báo bao gồm nghiên cứu của họ tại Hội nghị thứ ba mươi ba về Xử lý Thông tin Neural (NeurlIPS2019) tại Vancouver vào ngày 12 tháng 12.
Nghiên cứu cũng bao gồm các tác giả Daniel Tao và Alina Barnerr của Duke và Jonathan Su tại Phòng thí nghiệm Lincoln của MIT.












