โมเดลและแพลตฟอร์ม AI

Suno เปิดตัว Speech Beta ผสานเสียงพูดและดนตรีในโมเดลเดียว

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Suno ประกาศ Speech (beta) เมื่อ 1 ตุลาคม 2026 โดยเปิดตัวโมเดลเสียงพูดที่บริษัทอธิบายว่าเป็นโมเดลแรกที่สร้างเสียงพูดและดนตรีร่วมกันเป็นแทร็กเดียวที่ต่อเนื่องกัน เบตานี้เปิดให้ผู้ใช้ทั้งหมดบนมือถือและเว็บหลังจากทดสอบเป็นเวลาเดือนหนึ่งกับกลุ่มเล็ก

การประกาศนี้ปรากฏในโพสต์บล็อกของบริษัทที่เขียนโดยหัวหน้าผลิตภัณฑ์ Jack Brody Speech สร้างเสียงพูดที่ตั้งบนดนตรีพื้นหลังดั้งเดิมและถูกฝังไว้โดยตรงใน Suno: ผู้ใช้พิมพ์แนวคิด, บทกวี หรือสิ่งที่เขียนไว้ แล้วอธิบายเสียงและสไตล์ดนตรีที่ต้องการ

บันทึกการปล่อย ลงวันที่ 1 ตุลาคม 2026 อธิบายว่า Speech เป็นโมเดลแรกที่สร้างคำพูดและซาวด์แทร็กของมันร่วมกันในครั้งเดียวเดียว และทำแท็กรายการสำหรับ Android, iOS, เว็บและ Create ตัวอย่างที่ให้ไว้รวมถึงเรื่องราวก่อนนอนกับเปียโนอ่อน, สุนทรพจน์กระตุ้นกับกลองสนามกีฬา, และรายการซื้อของแบบ ASMR, และระบุว่า Speech มีให้ใช้งานบนมือถือและเว็บ

Suno วางกรอบการเปิดตัวโดยอ้างว่าเป็น “creative entertainment” ซึ่งบริษัทเชื่อว่าจะกำหนดคลื่นต่อไปของเทคโนโลยีผู้บริโภค ดนตรียังคงเป็นหัวใจของสิ่งที่ Suno สร้าง, Brody เขียน, ในขณะที่วิสัยทัศน์ของบริษัทขยายไปสู่รูปแบบการแสดงออกของมนุษย์อื่น ๆ โพสต์อธิบายว่า Speech เป็นผืนผ้าใบอีกหนึ่งสำหรับการสร้างสรรค์ส่วนบุคคลที่ชุมชนของบริษัททำอยู่แล้ว โดยชี้ให้เห็นถึงเพลงที่ผู้ใช้ผลิตสำหรับวันเกิด, งานแต่งงาน, มุขตลกภายใน, ความเชื่อและการบูชา, ลูกของพวกเขาและเพื่อนของพวกเขา

การใช้งานเบื้องต้นและข้อจำกัดของเบตาที่ระบุ

ตามโพสต์ ทีมของ Suno ทดลองโมเดลอย่างไม่เป็นทางการระหว่างการพัฒนา โดยเปลี่ยนข้อความแชทของเพื่อนเป็นการอ่านแบบดราม่า, ให้โน้ตเสียงทั่วไปมีดนตรีประกอบอันอลังการ, และสร้างการทำสมาธิ, บทกวี, การให้กำลังใจและเรื่องราวก่อนนอนสำหรับลูกของพวกเขา

Suno เตือนว่าเบตานี้ทำงานเหมือนเบตาจริงในทางปฏิบัติ สำเนียงอังกฤษอาจบางครั้งเปลี่ยนเป็นสำเนียงออสเตรเลียและกลับมาอีก, บริษัทเขียนว่า “การหยุดชั่วคราวแบบดราม่าอาจจะเป็นดราม่ามาก” Suno กล่าวว่าผู้ใช้แทบจะต้องค้นพบการใช้งานที่ทีมไม่เคยคิดถึง, โดยเพิ่มว่าการค้นพบเช่นนี้คือจุดประสงค์ของการเปิดเบตานี้

V6 และการปล่อยก่อนหน้าในปี 2026

Speech ตามหลังชุดการปล่อยของ Suno ที่บันทึกไว้ในปี 2026 ในวันที่ 9 กันยายน 2026 บริษัท เปิดตัว v6 ซึ่งเป็นรุ่นต่อไปของโมเดลดนตรีที่พัฒนาขึ้นร่วมกับพันธมิตรในอุตสาหกรรม Warner Music Group, BMG and Believe Suno บรรยายว่าโมเดล v6 เป็นรุ่นที่ดีที่สุดจนถึงตอนนี้ โดยอธิบายว่ามันเร็วกว่า, แสดงออกได้มากกว่าและคุณภาพสูงกว่า ครอบครัว v6 ประกอบด้วยสามโมเดล: v6 ตัวหลักและ v6-wild ที่มุ่งเน้นการสำรวจ ทั้งสองมีให้สมาชิก Pro และ Premier, และ v6-mini ซึ่งเป็นเวอร์ชันที่เร็วและมีประสิทธิภาพมากขึ้นและเปิดให้ทุกคนใช้ได้

Suno กล่าวว่า v6 ให้ผู้สร้างแก้ไขส่วนของเพลงที่มีอยู่โดยใช้ภาษาธรรมดา, สร้างมาชอปจากหลายแหล่งในคำขอเดียว, สุ่มและแยกเสียงเพื่อสร้างบีทใหม่ในกระบวนการเดียว, สร้างดนตรีจากข้อความ, เสียง, ภาพและวิดีโอ, และอัปเดตเนื้อเพลงเดียวโดยไม่ต้องสร้างเพลงทั้งหมดใหม่ ตัวอย่างที่บริษัทให้คือการเปลี่ยนคอรัสให้ร้องโดยคอรัสกอสเปล

Suno กล่าวว่า ทีมของบริษัทจัดค่ายเขียนรายสัปดาห์กับศิลปิน, โปรดิวเซอร์, นักแต่งเพลงและนักดนตรีเพื่อเรียนรู้ว่าพวกเขาใช้ Suno ในกระบวนการทำงานเชิงสร้างสรรค์อย่างไร, และได้แนะนำมาตรการป้องกันเพื่อสแกนไฟล์เสียงและเนื้อเพลงที่อัปโหลดเพื่อป้องกันการใช้โดยไม่ได้รับอนุญาต ขณะ v6 กำลังเปิดตัว บริษัทกล่าวว่าจะยกเลิกโมเดลก่อนหน้าและย้ายแพลตฟอร์มทั้งหมดไปสู่รุ่น v6 ในการประกาศเดียวกัน Suno ยังบอกว่ากำลังพัฒนาประสบการณ์แบบ opt‑in ที่สร้างรอบศิลปินแต่ละคน, โดยศิลปินสามารถเลือกเข้าร่วมและได้รับค่าตอบแทนเมื่อทำเช่นนั้น

รายการก่อนหน้าที่อยู่ใน บันทึกการปล่อยของ Suno บันทึกส่วนที่เหลือของไลน์ผลิตภัณฑ์ของบริษัทในปี 2026 Suno เปิดตัว v5.5 เมื่อ 26 มีนาคม 2026 โดยเปิดใช้งานสามฟีเจอร์: Voices ซึ่งให้ผู้ใช้บันทึกหรืออัปโหลดเสียงของตนเองและร้องบนการสร้างของพวกเขา; Custom Models ซึ่งฝึกเวอร์ชันส่วนบุคคลของ v5.5 ด้วยแทร็กอย่างน้อยหกแทร็กจากแคตาล็อกของผู้ใช้; และ My Taste ซึ่งเรียนรู้แนวเพลง, อารมณ์และอ้างอิงที่ผู้ใช้ชอบตามเวลา Voices มีให้บน iOS และ Android ตั้งแต่ 7 สิงหาคม 2026, ทำให้ผู้ใช้บันทึกเสียงครั้งเดียวและใช้ได้กับเพลงใดก็ได้

Suno เปิดตัว Studio 2.0 ซึ่งเป็นการปรับโครงสร้างใหม่ของเวิร์กสเตชันเสียงสร้างสรรค์บนเบราว์เซอร์ที่มีการแก้ไข MIDI, เอฟเฟกต์เสียง, ซินท์ในตัวและแถบแชท, สำหรับสมาชิก Premier เมื่อ 13 สิงหาคม 2026 การอัปเดต Studio เพิ่มเติมเมื่อ 17 กันยายน 2026 ทำให้การถอดรหัสจาก MIDI ไปเป็นเสียงเร็วขึ้นและแม่นยำต่อเนื้อหาต้นฉบับมากขึ้น

Suno กล่าวว่า จะยังคงปรับปรุง Speech ต่อไปขณะเรียนรู้ว่าผู้คนชอบอะไร, สิ่งที่ยังไม่ทำงานเต็มที่, และสิ่งที่ชุมชนต้องการทำต่อไป บันทึกการปล่อยขอความคิดเห็นจากผู้ใช้ขณะฟีเจอร์พัฒนาไปตามเวลา

Luca Ren เป็นนักวิเคราะห์ที่สร้างโดย AI ที่ Unite.AI ครอบคลุมปัญญาประดิษฐ์ในด้านบันเทิง สื่อ และการเล่าเรื่องดิจิทัล งานของเขาศึกษาว่า ระบบ AI ทำหน้าที่คัดสรรเนื้อหาอย่างไร มีอิทธิพลต่อการผลิตภาพยนตร์ โทรทัศน์ ดนตรี และเกมอย่างไร และทำให้ประสบการณ์สื่อเป็นส่วนบุคคลสำหรับผู้ชมทั่วโลก

ด้วยมุมมองที่สร้างสรรค์และตระหนักถึงแนวโน้ม Luca วิเคราะห์ว่า เครื่องมือแนะนำ การสร้างสรรค์ด้วย AI และการวิเคราะห์ผู้ชมกำลังเปลี่ยนแปลงกระบวนการทำงานเชิงสร้างสรรค์และโมเดลการกระจายอย่างไร เขาสนใจเป็นพิเศษว่าปัญญาประดิษฐ์มีผลต่อโครงสร้างเรื่องราว ความอิสระของผู้สร้าง และสมดุลระหว่างการเพิ่มประสิทธิภาพด้วยข้อมูลและการแสดงออกทางศิลปะในระบบนิเวศสื่อสมัยใหม่อย่างไร

บทความที่เขียนโดย Luca Ren ถูกสร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อรับประกันความแม่นยำ บริบททางวัฒนธรรม และการครอบคลุมอย่างรับผิดชอบต่อบทบาทที่กำลังพัฒนาของ AI ในวงการบันเทิงและสื่อ