โมเดลและแพลตฟอร์ม AI

วิสัยทัศน์แบบปริภูมิของ AI ที่สามารถปรับปรุงเทคโนโลยีและความปลอดภัยได้อย่างไร

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

วิสัยทัศน์แบบปริภูมิ ซึ่งเป็นด้านหนึ่งของการมองเห็นของมนุษย์ที่มักถูกมองข้าม มีบทบาทสำคัญในการที่เราสามารถโต้ตอบและเข้าใจสิ่งแวดล้อมของเราได้อย่างไร มันช่วยให้เราสามารถตรวจจับและรู้จำรูปร่าง การเคลื่อนไหว และสัญญาณที่สำคัญที่ไม่อยู่ในสายตาโดยตรง ทำให้เราสามารถขยายพื้นที่การมองเห็นของเราไปไกลกว่าพื้นที่จุดสนใจหลักได้ ความสามารถนี้มีความสำคัญต่อการทำงานในชีวิตประจำวัน ตั้งแต่การเดินในถนนคอนโดที่ยุ่งเหยิงไปจนถึงการตอบสนองต่อการเคลื่อนไหวที่ไม่คาดคิดในกีฬา

ที่สถาบันเทคโนโลยีแมสซาชูเซตส์ (MIT) นักวิจัยกำลังสำรวจด้านการเรียนรู้ของเครื่องจักรด้วยแนวทางใหม่ โดยมีเป้าหมายที่จะให้ความสามารถในการมองเห็นแบบปริภูมิแก่แบบจำลอง AI การทำงานที่เป็นนวัตกรรมนี้มีจุดมุ่งหมายที่จะเติมช่องว่างที่สำคัญในความสามารถของ AI ในปัจจุบัน ซึ่งไม่เหมือนกับมนุษย์ ไม่มีการรับรู้แบบปริภูมิ ความจำกัดนี้ในแบบจำลอง AI ทำให้ความสามารถของมันถูกจำกัดในสถานการณ์ที่การตรวจจับแบบปริภูมิเป็นสิ่งจำเป็น เช่น ระบบขับขี่อัตโนมัติหรือในสภาพแวดล้อมที่ซับซ้อนและเปลี่ยนแปลงอย่างรวดเร็ว

การทำความเข้าใจวิสัยทัศน์แบบปริภูมิใน AI

วิสัยทัศน์แบบปริภูมิในมนุษย์ถูกกำหนดโดยความสามารถในการรับรู้และตีความข้อมูลในบริเวณนอกจุดสนใจหลักของเรา แม้ว่าวิสัยทัศน์นี้จะมีรายละเอียดน้อยกว่าวิสัยทัศน์กลาง แต่ก็มีความไวต่อการเคลื่อนไหวสูงและเล่นบทบาทสำคัญในการเตือนเราเกี่ยวกับอันตรายและโอกาสที่อาจเกิดขึ้นในบริเวณของเรา

ในทางตรงกันข้าม แบบจำลอง AI มักต้องดิ้นรนกับด้านนี้ของการมองเห็น ระบบการมองเห็นของคอมพิวเตอร์ในปัจจุบันถูกออกแบบมาเพื่อประมวลผลและวิเคราะห์ภาพที่อยู่ในสายตาโดยตรง คล้ายกับการมองเห็นกลางในมนุษย์ สิ่งนี้ทำให้เกิดจุดบอดที่สำคัญในความสามารถการรับรู้ของ AI โดยเฉพาะในสถานการณ์ที่ข้อมูลแบบปริภูมิเป็นสิ่งสำคัญสำหรับการตัดสินใจหรือตอบสนองต่อการเปลี่ยนแปลงที่ไม่คาดคิดในบริเวณ

การวิจัยที่ดำเนินการโดย MIT จัดการกับช่องว่างที่สำคัญนี้ โดยการรวมวิสัยทัศน์แบบปริภูมิเข้ากับแบบจำลอง AI ทีมงานมีเป้าหมายที่จะสร้างระบบที่ไม่เพียงแต่เห็นเท่านั้น แต่ยังตีความโลกในลักษณะที่ใกล้เคียงกับการมองเห็นของมนุษย์มากขึ้น ความก้าวหน้านี้มีศักยภาพที่จะปรับปรุงการประยุกต์ใช้ AI ในหลายสาขา ตั้งแต่ความปลอดภัยทางรถยนต์ไปจนถึงหุ่นยนต์ และอาจมีส่วนช่วยให้เราเข้าใจการประมวลผลการมองเห็นของมนุษย์ด้วย

แนวทางของ MIT

เพื่อให้บรรลุเป้าหมายนี้ พวกเขากำลังพัฒนาแนวทางใหม่ในการประมวลผลและรับรู้ภาพโดย AI โดยมีจุดศูนย์กลางอยู่ที่การใช้แบบจำลองการปูพื้นผิวที่ได้รับการดัดแปลง วิธีการแบบดั้งเดิมมักจะพึ่งพาการเบลอขอบของภาพเพื่อเลียนแบบวิสัยทัศน์แบบปริภูมิ อย่างไรก็ตาม นักวิจัยของ MIT ตระหนักว่าวิธีการนี้ไม่เพียงพอในการแสดงถึงการเสียหายของข้อมูลที่ซับซ้อนซึ่งเกิดขึ้นในวิสัยทัศน์แบบปริภูมิของมนุษย์

เพื่อแก้ไขปัญหานี้ พวกเขาพัฒนาบทจำลองการปูพื้นผิวที่ได้รับการดัดแปลง ซึ่งเป็นเทคนิคที่ออกแบบมาเพื่อเลียนแบบวิสัยทัศน์แบบปริภูมิของมนุษย์ แบบจำลองที่ได้รับการดัดแปลงนี้ช่วยให้สามารถเปลี่ยนแปลงภาพได้อย่างละเอียด โดยจับภาพการเสียหายของรายละเอียดที่เกิดขึ้นเมื่อมองจากจุดศูนย์กลางไปยังบริเวณนอกจุดสนใจหลัก

ส่วนสำคัญของการพยายามครั้งนี้คือการสร้างชุดข้อมูลที่ครอบคลุม ซึ่งได้รับการออกแบบมาเพื่อฝึกอบรมแบบจำลองการเรียนรู้ของเครื่องจักรในการรับรู้และตีความข้อมูลการมองเห็นแบบปริภูมิ ชุดข้อมูลนี้ประกอบด้วยภาพจำนวนมาก แต่ละภาพได้รับการเปลี่ยนแปลงอย่างรอบคอบเพื่อแสดงระดับการมองเห็นแบบปริภูมิที่แตกต่างกัน โดยการฝึกอบรมแบบจำลอง AI ด้วยชุดข้อมูลนี้ นักวิจัยมีเป้าหมายที่จะให้ความสามารถในการรับรู้ภาพแบบปริภูมิที่สมจริงแก่แบบจำลอง AI ซึ่งคล้ายกับการประมวลผลการมองเห็นของมนุษย์

ผลการวิจัยและผลกระทบ

หลังจากฝึกอบรมแบบจำลอง AI ด้วยชุดข้อมูลใหม่นี้ ทีมงานของ MIT ได้ดำเนินการเปรียบเทียบอย่างรอบคอบระหว่างความสามารถของแบบจำลองเหล่านี้กับความสามารถของมนุษย์ในการตรวจจับวัตถุ ผลลัพธ์เป็นการเปิดเผย

หนึ่งในผลการค้นพบที่น่าประทับใจที่สุดคือรูปแบบการทำงานที่แตกต่างกันและข้อจำกัดที่มีอยู่ใน AI ในบริบทนี้ ซึ่งไม่เหมือนกับมนุษย์ ขนาดของวัตถุหรือปริมาณของสิ่งรบกวนการมองเห็นไม่ส่งผลกระทบอย่างมีนัยสำคัญต่อประสิทธิภาพของแบบจำลอง AI ซึ่งบ่งชี้ถึงความแตกต่างพื้นฐานในการประมวลผลข้อมูลการมองเห็นแบบปริภูมิระหว่าง AI และมนุษย์

ผลการค้นพบเหล่านี้มีผลกระทบอย่างลึกซึ้งสำหรับการประยุกต์ใช้หลายอย่าง ในด้านความปลอดภัยทางรถยนต์ ระบบ AI ที่มีวิสัยทัศน์แบบปริภูมิที่ได้รับการปรับปรุงสามารถลดอุบัติเหตุได้อย่างมากโดยการตรวจจับอันตรายที่อาจเกิดขึ้นที่อยู่นอกสายตาของผู้ขับขี่หรือเซ็นเซอร์ เทคโนโลยีนี้ยังสามารถมีบทบาทสำคัญในการทำความเข้าใจพฤติกรรมของมนุษย์ โดยเฉพาะอย่างยิ่งในการประมวลผลและตอบสนองต่อสิ่งเร้าการมองเห็นในบริเวณของเรา

นอกจากนี้ ความก้าวหน้านี้ยังมีศักยภาพในการปรับปรุงอินเทอร์เฟซผู้ใช้ โดยการทำความเข้าใจว่า AI ประมวลผลวิสัยทัศน์แบบปริภูมิอย่างไร นักออกแบบและวิศวกรสามารถพัฒนาแพลตฟอร์มที่มีความสอดคล้องกับการมองเห็นของมนุษย์มากขึ้น ทำให้ระบบมีความเป็นมิตรและตอบสนองต่อผู้ใช้มากขึ้น

โดยสรุป การทำงานของนักวิจัยที่ MIT ไม่เพียงแต่แสดงถึงขั้นตอนสำคัญในการพัฒนาวิสัยทัศน์ของ AI แต่ยังเปิดโอกาสใหม่สำหรับการปรับปรุงความปลอดภัย การทำความเข้าใจการรับรู้ของมนุษย์ และการปรับปรุงการโต้ตอบของผู้ใช้กับเทคโนโลยี

โดยการเชื่อมช่องว่างระหว่างการรับรู้ของมนุษย์และเครื่องจักร การวิจัยนี้เปิดโอกาสมากมายสำหรับการพัฒนเทคโนโลยีและความปลอดภัย ผลกระทบของการศึกษานี้ขยายไปสู่หลายสาขา โดยสัญญาว่าจะมีอนาคตที่ AI ไม่เพียงแต่เห็นได้ดีขึ้นเท่านั้น แต่ยังเข้าใจและโต้ตอบกับโลกในลักษณะที่ซับซ้อนและเข้าใจได้มากขึ้น

Alex McFarland เป็นนักข่าวและนักเขียน AI ที่สำรวจการพัฒนาล่าสุดในด้านปัญญาประดิษฐ์ เขาได้ร่วมงานกับสตาร์ทอัพ AI และสื่อสิ่งพิมพ์ต่างๆ ทั่วโลก