โมเดลและแพลตฟอร์ม AI

หูฟัง AI ที่ช่วยให้คุณฟังเสียงคนเดียวในฝูงชน

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

ในสถานที่ที่มีคนเยอะและเสียงดัง คุณเคยต้องการที่จะฟังเสียงคนเดียวที่คุณต้องการฟังโดยไม่ถูกรบกวนจากเสียงอื่นๆ หรือไม่ ในขณะที่หูฟังที่มีการยกเลิกเสียงดังได้ทำการปรับปรุงให้ดีขึ้นในการสร้างพื้นฐานเสียงที่ว่างเปล่า แต่ยังคงพยายามที่จะให้เสียงเฉพาะจากสภาพแวดล้อมของผู้สวมหูฟังสามารถกรองผ่านได้ แต่ถ้าหูฟังของคุณสามารถถูกฝึกให้สามารถจับและขยายเสียงของคนเดียวได้ แม้ว่าคุณจะเดินไปรอบๆ ในห้องที่มีคนพูดกันหลายคนก็ตาม

Target Speech Hearing (TSH) ซึ่งเป็นระบบ AI ที่ถูกพัฒนาโดยนักวิจัยจากมหาวิทยาลัยวอชิงตัน กำลังทำความก้าวหน้าในด้านนี้

วิธีการทำงานของ Target Speech Hearing

ในการใช้ TSH ผู้สวมหูฟังเพียงแค่ต้องมองไปที่บุคคลที่ต้องการฟังเป็นเวลาไม่กี่วินาที ซึ่งเป็นช่วงเวลา “การลงทะเบียน” ที่ช่วยให้ระบบ AI สามารถเรียนรู้และจับเสียงพูดที่เป็นเอกลักษณ์ของผู้พูดเป้าหมาย

นี่คือวิธีการทำงานของมัน:

  1. ผู้ใช้กดปุ่มในขณะที่หันหน้าไปทางผู้พูดที่ต้องการฟังเป็นเวลา 3-5 วินาที
  2. ไมโครโฟนทั้งสองด้านของหูฟังจับเสียงจากเสียงพูดของผู้พูดเป้าหมายพร้อมกัน (ด้วยข้อผิดพลาด 16 องศา)
  3. หูฟังส่งสัญญาณเสียงนี้ไปยังคอมพิวเตอร์ที่ฝังตัว
  4. ซอฟต์แวร์ Machine Learning วิเคราะห์เสียงและสร้างแบบจำลองของลักษณะเสียงพูดที่เป็นเอกลักษณ์ของผู้พูด
  5. ระบบ AI ใช้แบบจำลองนี้เพื่อแยกและขยายเสียงของผู้พูดเป้าหมายในเวลาจริง แม้ว่าผู้ใช้จะเดินไปรอบๆ ในสภาพแวดล้อมที่มีเสียงดัง

เมื่อผู้พูดเป้าหมายพูดมากขึ้น ระบบจะได้รับข้อมูลการฝึกมากขึ้น ซึ่งช่วยให้สามารถมุ่งเน้นและชัดเจนเสียงที่ต้องการได้ดีขึ้น การเข้าถึงเสียงที่เลือกนี้เปิดโอกาสให้สามารถปรับปรุงการสื่อสารและความสามารถในการเข้าถึงในสถานที่ที่มีเสียงดัง

Shyam Gollakota เป็นนักวิจัยหลักของเอกสารและเป็นศาสตราจารย์ที่ Paul G. Allen School of Computer Science & Engineering

“เราเคยคิดว่า AI เป็นเพียงช่องทางสื่อสารบนเว็บที่ตอบคำถาม แต่ในโครงการนี้ เราพัฒนา AI เพื่อปรับเปลี่ยนการรับรู้ทาง слухของใครก็ตามที่สวมหูฟัง ตามความชอบของพวกเขา ด้วยอุปกรณ์ของเรา คุณสามารถฟังเสียงของผู้พูดคนเดียวได้อย่างชัดเจน แม้ว่าคุณจะอยู่ในสถานที่ที่มีคนพูดกันหลายคน” – Gollakota

การทดสอบหูฟัง AI ด้วย TSH

เพื่อทดสอบ Target Speech Hearing ทีมวิจัยได้ทำการศึกษาโดยมีผู้เข้าร่วมทั้งหมด 21 คน ผู้เข้าร่วมแต่ละคนสวมหูฟัง TSH และลงทะเบียนผู้พูดเป้าหมายในสถานที่ที่มีเสียงดัง ผลลัพธ์เป็นที่น่าประทับใจ – ผู้ใช้ให้คะแนนความชัดเจนของเสียงผู้พูดเป้าหมายสูงกว่าเสียงที่ไม่ได้ถูกกรองถึงสองเท่า

การทำความก้าวหน้านี้ต่อยอดจากงานวิจัยก่อนหน้าของทีมเกี่ยวกับ “การฟังเชิงคำนึง” ซึ่งช่วยให้ผู้ใช้สามารถกรองสภาพแวดล้อมทาง слухตามการจำแนกประเภทเสียงที่กำหนดไว้ล่วงหน้า เช่น เสียงนกหรือเสียงพูดของมนุษย์ TSH นำแนวคิดนี้ไปสู่ขั้นตอนต่อไปโดยการทำให้ผู้ใช้สามารถขยายเสียงของผู้พูดคนเดียวได้

ผลกระทบนี้มีความสำคัญตั้งแต่การปรับปรุงการสื่อสารส่วนตัวในสถานที่ที่มีเสียงดังไปจนถึงการปรับปรุงความสามารถในการเข้าถึงสำหรับผู้ที่มีปัญหาการได้ยิน เมื่อเทคโนโลยีนี้พัฒนาไป คุณสามารถเปลี่ยนแปลงวิธีที่เราสัมผัสและโต้ตอบกับโลกทาง слухของเราได้

การปรับปรุงหูฟัง AI และการเอาชนะข้อจำกัด

แม้ว่า Target Speech Hearing จะเป็นตัวแทนของความก้าวหน้าครั้งใหญ่ในด้าน AI การฟัง แต่ระบบนี้ก็มีข้อจำกัดในรูปแบบปัจจุบัน:

  • การลงทะเบียนผู้พูดคนเดียว: ปัจจุบัน TSH สามารถฝึกให้ฟังเสียงของผู้พูดคนเดียวได้เท่านั้น การลงทะเบียนผู้พูดหลายคนในเวลาเดียวกันยังไม่สามารถทำได้
  • การรบกวนจากแหล่งเสียงที่คล้ายกัน: หากมีเสียงดังอื่นมาจากทิศทางเดียวกับผู้พูดเป้าหมายในช่วงการลงทะเบียน ระบบอาจต้องพยายามแยกเสียงพูดที่เป็นเอกลักษณ์ของผู้พูดเป้าหมาย
  • การลงทะเบียนใหม่ด้วยตนเอง: หากผู้ใช้ไม่พอใจคุณภาพเสียงหลังจากการฝึกครั้งแรก พวกเขาจะต้องลงทะเบียนผู้พูดเป้าหมายใหม่เพื่อปรับปรุงความชัดเจน

尽管มีข้อจำกัดเหล่านี้ ทีมวิจัยจากมหาวิทยาลัยวอชิงตันยังคงทำงานอย่างต่อเนื่องเพื่อปรับปรุงและขยายความสามารถของ TSH หนึ่งในเป้าหมายหลักของพวกเขาคือการย่อขนาดเทคโนโลยีนี้ให้เล็กลง เพื่อให้สามารถรวมเข้ากับผลิตภัณฑ์สำหรับผู้บริโภค เช่น หูฟังและเครื่องช่วยฟัง

เมื่อนักวิจัยยังคงผลักดันขอบเขตของสิ่งที่เป็นไปได้กับ AI การฟัง การใช้งานที่เป็นไปได้จะกว้างขวางตั้งแต่การปรับปรุงประสิทธิภาพในการทำงานในสถานที่ที่มีเสียงดังไปจนถึงการอำนวยความสะดวกในการสื่อสารที่ชัดเจนสำหรับผู้ตอบโต้และบุคลากรทางทหารในสถานการณ์ที่มีความเสี่ยงสูง อนาคตของการฟังที่เลือกจะสดใส และ Target Speech Hearing มีบทบาทสำคัญในการกำหนดรูปแบบอนาคต

Alex McFarland เป็นนักข่าวและนักเขียน AI ที่สำรวจการพัฒนาล่าสุดในด้านปัญญาประดิษฐ์ เขาได้ร่วมงานกับสตาร์ทอัพ AI และสื่อสิ่งพิมพ์ต่างๆ ทั่วโลก