โมเดลและแพลตฟอร์ม AI

Google เปิดตัวการสร้างดนตรี Lyria 3.5 ในแอป Gemini และ API

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Google เมื่อวันที่ 4 กันยายน 2026 ทำให้ Lyria 3.5 โมเดลการสร้างดนตรีของบริษัท พร้อมให้ใช้งานในแอป Gemini และ Gemini API ขยายการใช้งานโมเดลนี้ออกไปนอกเครื่องมือ Google Flow Music ที่เปิดตัวเมื่อต้นปีนี้ โมเดลนี้พร้อมให้ผู้ใช้ Gemini ทั่วโลกบนเว็บและแอปมือถือ ตามที่บริษัทระบุใน ประกาศบน The Keyword

Google บรรยาย Lyria 3.5 ว่าเป็นโมเดลการสร้างดนตรีที่ให้เสียงดีที่สุดของบริษัท และกล่าวว่ามันนำเสนอเสียงร้องที่มีอารมณ์มากขึ้นและการจัดเรียงดนตรีที่หลากหลายกว่าเวอร์ชันก่อนหน้า ทำให้ได้แทร็กที่มีความละเอียดสูงกว่า โมเดลนี้เปิดตัวครั้งแรกใน Google Flow Music เมื่อวันที่ 29 กรกฎาคม 2026 โดย Google ระบุว่ามีการปรับปรุงด้านความเป็นดนตรี เนื้อเพลง และคุณภาพของเสียงร้อง

การควบคุมการสร้างใหม่ในแอป Gemini

เวอร์ชันของ Lyria 3.5 ในแอป Gemini เพิ่มชุดคุณสมบัติการสร้างที่แนะนำให้ผู้ใช้ ผู้ใช้สามารถเลือกหรืออธิบายแนวเพลงและเลือกสไตล์ระหว่างเสียงร้องหรือดนตรีเครื่องดนตรี เทมเพลตใหม่ถูกออกแบบให้เริ่มโครงการตั้งแต่ดนตรีพื้นหลังจนถึงแทร็กวันเกิดแบบกำหนดเอง และผู้ใช้สามารถเลือกได้ระหว่างแทร็กสั้นหรือยาว

Google ระบุว่าฟีเจอร์นี้มุ่งเน้นการใช้งานเช่นแทร็กสนับสนุนแบบกำหนดเองสำหรับวิดีโอ, เพลงโฆษณาแบรนด์, และริงโทนส่วนบุคคล นอกแอป Lyria 3.5 ยังพร้อมให้ศิลปินและผู้สร้าง AI ใช้ใน Google Flow Music และสำหรับนักพัฒนาและผู้เชี่ยวชาญผ่าน Google AI Studio และ Google Vids

Google DeepMind’s หน้าโมเดลสำหรับตระกูล Lyria ระบุว่าโมเดลนี้รองรับความยาวเพลงที่เปลี่ยนแปลงได้สูงสุดสามนาที พร้อมความสามารถในการสร้างแทร็กที่ต่อเนื่องตามระยะเวลาที่ต้องการ ตั้งแต่คลิป 60 วินาทีจนถึงเพลงเต็มสามนาที หน้าเว็บกล่าวว่าผู้ใช้สามารถเขียนเนื้อเพลงของตนเองหรือสร้างเนื้อเพลงตามหัวข้อหรือธีมเฉพาะ และสามารถกำหนดสไตล์เสียงร้องและการตั้งค่าเสียงได้ นอกจากนี้ยังอธิบายการแต่งเพลงด้วยภาพ: ผู้ใช้สามารถอัปโหลดภาพและให้โมเดลแปลงเป็นแทร็ก

การเข้าถึงสำหรับนักพัฒนาผ่าน Gemini API

ตาม เอกสารสำหรับนักพัฒนาการสร้างดนตรี ของ Google ที่อัปเดตเมื่อ 4 กันยายน 2026 Lyria 3.5 สร้างเสียงสเตอริโอ 44.1 kHz จากข้อความหรือภาพ พร้อมความสอดคล้องของโครงสร้างที่รวมเสียงร้อง เนื้อเพลงตามเวลา และการจัดเรียงดนตรีเต็มรูปแบบ เอกสารระบุว่ามีสองโมเดล: Lyria 3 Clip ที่ใช้รหัสโมเดล lyria-3-clip-preview ซึ่งจะสร้างคลิป 30 วินาทีสำหรับลูปและพรีวิวเสมอ และ Lyria 3.5 ที่ใช้รหัสโมเดล lyria-3.5 ซึ่งสร้างเพลงเต็มที่มีท่อนร้อง, คอรัส, และบริดจ์ที่ยาวหลายนาที

ทั้งสองโมเดลสามารถเข้าถึงได้ผ่าน Interactions API ของ Google และโดยค่าเริ่มต้นจะส่งออกเป็นไฟล์ MP3 โดยมีตัวเลือกการส่งออกเป็น WAV สำหรับ Lyria 3.5 เอกสารระบุว่าผู้พัฒนาสามารถให้ภาพได้สูงสุด 10 รูปพร้อมข้อความสั่งการ และโมเดลจะประพันธ์ดนตรีโดยอิงจากเนื้อหาภาพนั้น พวกเขายังสามารถใส่เนื้อเพลงกำหนดเองโดยใช้แท็กส่วนเช่น Verse, Chorus, และ Bridge และใช้ไทม์สแตมป์เพื่อระบุเหตุการณ์ในช่วงเวลาต่าง ๆ ของเพลง เช่น เมื่อเครื่องดนตรีเข้ามา การสั่งการด้วยภาษาที่กำหนดจะสร้างเนื้อเพลงในภาษานั้นตามที่เอกสารระบุ โดยโมเดลจะปรับสไตล์เสียงและการออกเสียงให้สอดคล้อง ก่อนที่เสียงจะถูกสร้าง โมเดลจะวิเคราะห์โครงสร้างดนตรีตามข้อความสั่งการ

ข้อจำกัดที่ระบุและการใส่น้ำลายน้ำ

เอกสารสำหรับนักพัฒนาระบุข้อจำกัดหลายประการ ทุกข้อความสั่งการจะผ่านตัวกรองความปลอดภัย และการขอเสียงของศิลปินเฉพาะหรือการสร้างเนื้อเพลงที่มีลิขสิทธิ์จะถูกบล็อก การสร้างดนตรีเป็นกระบวนการแบบครั้งเดียว ดังนั้นการแก้ไขคลิปที่สร้างขึ้นอย่างต่อเนื่องผ่านหลายข้อความสั่งการจึงไม่ได้รับการสนับสนุนในเวอร์ชันปัจจุบัน ผลลัพธ์อาจแตกต่างกันระหว่างการเรียกใช้งานแม้ใช้ข้อความเดียวกัน

เสียงที่สร้างทั้งหมดจะมีน้ำลายน้ำ SynthID เพื่อการระบุ ซึ่ง Google ระบุว่าไม่สามารถรับรู้ได้ด้วยหูมนุษย์ หน้าโมเดลของ DeepMind กล่าวว่าแทร็กทั้งหมดมีน้ำลายน้ำ SynthID อย่างไม่รู้สึกได้ เพื่อให้ผู้ฟังและแพลตฟอร์มสามารถตรวจจับได้ว่าดนตรีถูกสร้างหรือแก้ไขด้วย AI หรือไม่ และ Google ใช้การกรองและการทำเครื่องหมายข้อมูลอย่างกว้างขวางเพื่อลดเนื้อหาที่เป็นอันตรายในชุดข้อมูลฝึกและความเป็นไปได้ของเนื้อเพลงที่เป็นอันตราย หน้าเว็บยังระบุว่า Google ยังคงพัฒนาความสามารถสำคัญและแนะนำให้ผู้ใช้ตรวจสอบว่าแทร็กที่สร้างตรงกับวิสัยทัศน์ของตนหรือไม่

หน้าเว็บของ DeepMind ยังระบุว่าตระกูล Lyria ได้รับการพัฒนาจากการร่วมมือกับผู้ผลิตและนักดนตรี และได้แสดงรายการการทดลองของศิลปินก่อนหน้ากับเครื่องมือดนตรีของ Google รวมถึงผลงานของโปรดิวเซอร์ Wyclef Jean กับ Music AI Sandbox และการใช้ Lyria ของ Yung Spielburg ในการแต่งเพลงให้กับภาพยนตร์สั้นแอนิเมชัน Dear Upstairs Neighbors Lyria 3.5 พร้อมให้บริการผ่านแอป Gemini, Google Flow Music, Google AI Studio และ Google Vids ตั้งแต่วันที่ 4 กันยายน 2026

Luca Ren เป็นนักวิเคราะห์ที่สร้างโดย AI ที่ Unite.AI ครอบคลุมปัญญาประดิษฐ์ในด้านบันเทิง สื่อ และการเล่าเรื่องดิจิทัล งานของเขาศึกษาว่า ระบบ AI ทำหน้าที่คัดสรรเนื้อหาอย่างไร มีอิทธิพลต่อการผลิตภาพยนตร์ โทรทัศน์ ดนตรี และเกมอย่างไร และทำให้ประสบการณ์สื่อเป็นส่วนบุคคลสำหรับผู้ชมทั่วโลก

ด้วยมุมมองที่สร้างสรรค์และตระหนักถึงแนวโน้ม Luca วิเคราะห์ว่า เครื่องมือแนะนำ การสร้างสรรค์ด้วย AI และการวิเคราะห์ผู้ชมกำลังเปลี่ยนแปลงกระบวนการทำงานเชิงสร้างสรรค์และโมเดลการกระจายอย่างไร เขาสนใจเป็นพิเศษว่าปัญญาประดิษฐ์มีผลต่อโครงสร้างเรื่องราว ความอิสระของผู้สร้าง และสมดุลระหว่างการเพิ่มประสิทธิภาพด้วยข้อมูลและการแสดงออกทางศิลปะในระบบนิเวศสื่อสมัยใหม่อย่างไร

บทความที่เขียนโดย Luca Ren ถูกสร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อรับประกันความแม่นยำ บริบททางวัฒนธรรม และการครอบคลุมอย่างรับผิดชอบต่อบทบาทที่กำลังพัฒนาของ AI ในวงการบันเทิงและสื่อ