โมเดลและแพลตฟอร์ม AI

นักพัฒนาเกมมองหาวิธีสร้างโอกาสใหม่ๆ ด้วยเทคโนโลยีเสียง AI

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

เทคโนโลยีการสังเคราะห์เสียง โดยเฉพาะเทคโนโลยีการสังเคราะห์เสียงพูด ได้พัฒนาอย่างมากในช่วงไม่กี่ปีที่ผ่านมา เทคโนโลยีการแปลงข้อความเป็นเสียงพูดได้ถูกพัฒนามานานหลายทศวรรษ แต่เทคโนโลยีนี้ได้กลายเป็นเสียงที่มีเสียงธรรมชาติมากขึ้น ในปัจจุบัน อัลกอริทึมใหม่สามารถใช้เวลาเพียงไม่กี่ชั่วโมงในการสร้างตัวอย่างเสียงที่มีเสียงจริงได้ เมื่อเทคโนโลยีนี้พัฒนาไปมากขึ้น จะมีการใช้งานที่หลากหลายมากขึ้น รวมถึงโอกาสในการใช้งานในด้านสื่อสร้างสรรค์ เมื่อเร็วๆ นี้ ตามรายงานของ VentureBeat บริษัทพัฒนาเกมได้เริ่มสำรวจการใช้เทคโนโลยี AI ในการสร้างเสียงพูดสำหรับเกม

บริษัทหนึ่ง คือ Leviathan Games ได้เริ่มใช้เทคโนโลยีเสียง AI ในเกมที่กำลังพัฒนา Wyeth Ridgway เจ้าของ Leviathan Games อธิบายว่าเทคโนโลยีเสียง AI สามารถเปลี่ยนแปลงการออกแบบเกมได้อย่างมาก Ridgway อธิบายว่าการใช้เทคโนโลยีเสียง AI ในการออกแบบเกมเป็นเทรนด์ที่เกิดขึ้นใหม่ และเปรียบเทียบกับการที่ซอฟต์แวร์สร้างสรรค์ 3D มีการเปลี่ยนแปลงไปตลอดทศวรรษที่ผ่านมา โดยบริษัทอย่าง Pixar ได้สร้างซอฟต์แวร์เฉพาะที่ช่วยให้การสร้างสรรค์และการสร้างแบบจำลองได้ง่ายขึ้น

วิธีการสร้างเสียงพูดแบบดั้งเดิมจะใช้การเชื่อมต่อไฟล์เสียงที่บันทึกไว้ล่วงหน้าเข้าด้วยกัน โดยการเชื่อมต่อประโยคเข้าด้วยกันจากคำและวลีที่มีอยู่แล้ว วิธีนี้ต้องการการบันทึกเสียงหลายร้อยชั่วโมงและต้องมีการทำเครื่องหมายเสียงด้วยมือ นอกจากนี้ยังดูไม่ธรรมชาติเพราะน้ำเสียงและความเครียดมักจะเปลี่ยนแปลงไปตามคำและประโยค ในทางกลับกัน เทคโนโลยีเสียง AI ที่ทันสมัยมีเสียงที่ดูธรรมชาติมากขึ้นและทำงานในลักษณะที่แตกต่าง

เทคโนโลยีเสียง AI ขึ้นอยู่กับเครือข่ายประสาทลึก WaveNet เป็นหนึ่งใน AI ที่สามารถสร้างตัวอย่างเสียงที่มีเสียงจริงและดูธรรมชาติได้ เนื่องจากตัวอย่างเสียงถูกสร้างขึ้นจากศูนย์ จึงไม่ต้องบันทึกเสียงหลายร้อยชั่วโมง หากมีข้อมูลการฝึกอบรมที่เพียงพอ โมเดล GAN และ LSTM ที่ได้รับการปรับให้เหมาะสมสามารถสร้างเสียงหลังจากได้รับการฝึกอบรมจากเสียงที่มีเครื่องหมายเพียงไม่กี่ชั่วโมง ผลลัพธ์สามารถน่าเชื่อถือได้อย่างมาก เช่น เมื่อ Google (GOOGL ) Duplex ทดลองโทรศัพท์ไปที่ร้านทำผมเพื่อนัดหมาย

เมื่อเทคโนโลยีเหล่านี้มีประสิทธิภาพ มาตรฐาน และสามารถเข้าถึงได้ง่ายผ่านการประมวลผลแบบคลาวด์ มีแนวโน้มว่านักพัฒนาเกมจะหันมาใช้เทคโนโลยีเสียง AI เพื่อลดเวลาและต้นทุนการผลิต บริษัทบางแห่งได้สร้างโมเดลที่สามารถใช้ได้โดยนักพัฒนาเกม Replica Studios เป็นพิเศษด้านเทคโนโลยีเสียง AI และตัวอย่างเสียงที่สร้างโดยเทคโนโลยีนี้สามารถฟังได้ที่ลิงก์เหล่านี้

ไม่น่าจะเป็นไปได้ที่นักพัฒนาเกมจะเลือกที่จะไม่ใช้เสียงพูดของนักแสดงเสียงโดยใช้ AI เทคโนโลยีเสียง AI อาจเปิดโอกาสให้นักแสดงเสียงได้มากขึ้น ในปัจจุบันหลายบริษัทพัฒนาเกมมักจะไม่มีเสียงพูดในเกมเนื่องจากการลงทุนเวลาและต้นทุนที่เกี่ยวข้องกับการสร้างเสียงพูด นักแสดงเสียงมักต้องถูกเรียกกลับมาทำการบันทึกเสียงเพิ่มเติมหากมีการเปลี่ยนแปลงในบทหรือหากผู้กำกับเกมต้องการการแสดงออกที่แตกต่าง เทคโนโลยีเสียง AI สามารถใช้ในการทดลองและสร้างเสียงพูดได้ ทำให้บริษัทมีทรัพยากรในการลงทุนในการสร้างเสียงพูดมากขึ้น

โมเดลเสียง AI สามารถถูกฝึกอบรมด้วยเสียงของนักแสดงเสียงเฉพาะ และใช้ในการสร้างเสียงพูดที่ไม่สำคัญ ตราบเท่าที่นักแสดงเสียงได้รับค่าตอบแทนจากการใช้เสียงของตนเอง ตามรายงานของ VentureBeat นักแสดงเสียงอย่าง Simon J. Smith มีความหวังว่าเทคโนโลยีเสียง AI จะเปิดโอกาสให้นักแสดงเสียงได้มากขึ้น

นอกเหนือจากการใช้เทคโนโลยีเสียง AI ในการสร้างเสียงพูดหรือทดลองบท นักพัฒนาเกมยังสามารถใช้เทคโนโลยีเสียง AI เพื่อให้ผู้เล่นมีตัวเลือกการปรับแต่งตัวละครในเกมมากขึ้น ปัจจุบันเกมที่อนุญาตให้ผู้เล่นเลือกเสียงสำหรับตัวละครของตนมักจะมีตัวเลือกเพียงไม่กี่ตัว แต่ด้วยการใช้เทคโนโลยีเสียง AI ตัวเลือกเหล่านั้นสามารถมีได้ไม่จำกัด

นักบล็อกและโปรแกรมเมอร์ที่มีความเชี่ยวชาญใน Machine Learning และ Deep Learning หัวข้อ Daniel หวังที่จะช่วยให้ผู้อื่นใช้พลังของ AI สำหรับสิ่งที่ดี