โมเดลและแพลตฟอร์ม AI

โชตบอท Meena ใหม่ของ Google สามารถสนทนาที่มีเหตุผลและเฉพาะเจาะจงเกี่ยวกับเรื่องเกือบใดๆ ได้

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

ถึงแม้ว่าผู้ช่วยเสมือนอย่าง Siri, Alexa และ Google Assistant จะมีความสามารถที่น่าประทับใจและเป็นประโยชน์ แต่ความสามารถในการสนทนาของพวกมันโดยทั่วไปมักจะถูกจำกัดให้รับคำสั่งบางอย่างและตอบสนองด้วยคำตอบที่กำหนดไว้ล่วงหน้า บริษัทอย่าง Google และ Amazon (AMZN ) ได้พยายามพัฒนาวิธีการฝึกอบรม AI และพัฒนา AI ที่สามารถทำให้ โชตบอทมีความสามารถในการสนทนาได้มากขึ้นและยืดหยุ่นมากขึ้น เพื่อให้สามารถสนทนากับผู้ใช้ได้อย่างมีธรรมชาติมากขึ้น ตามรายงานของ DigitalTrends Google ได้ตีพิมพ์เอกสารวิจัยที่แสดงถึงความสามารถของ โชตบอทใหม่ของตนซึ่งมีชื่อว่า “Meena” ตามบล็อกโพสต์ ของนักวิจัย Meena สามารถสนทนากับผู้ใช้ได้เกี่ยวกับเรื่องใดๆ ก็ตาม

Meena เป็น โชตบอทที่มีโดเมนเปิด ซึ่งหมายความว่ามันจะตอบสนองตามบริบทของการสนทนาและปรับให้เข้ากับการป้อนข้อมูลเพื่อให้ได้คำตอบที่เป็นธรรมชาติมากขึ้น โชตบอทส่วนใหญ่อื่นๆ เป็น โชตบอทที่มีโดเมนปิด ซึ่งหมายความว่าคำตอบของพวกมันจะถูกกำหนดโดยแนวคิดและเป้าหมายเฉพาะ

ตามรายงานของ Google ความยืดหยุ่นของ Meena เป็นผลมาจากชุดข้อมูลการฝึกอบรมที่มีขนาดใหญ่มาก Meena ได้รับการฝึกอบรมจากข้อมูลประมาณ 40 พันล้านคำที่ถูกดึงมาจากการสนทนาในโซเชียลมีเดียและถูกกรองเพื่อให้ได้คำที่เกี่ยวข้องและเป็นตัวแทนมากที่สุด Google ได้พยายามแก้ไขปัญหาที่พบในผู้ช่วยเสมือนส่วนใหญ่ เช่น ความสามารถในการจัดการหัวข้อและคำสั่งที่เกิดขึ้นในหลายๆ รอบของการสนทนา โดยที่ผู้ใช้ให้ข้อมูลเพิ่มเติมหลังจากที่ โชตบอทตอบสนองต่อข้อมูลหนึ่งครั้ง

เพื่อแก้ไขปัญหานี้ นักวิจัยของ Google ได้ทำให้ โชตบอทสามารถติดตามบริบทของการสนทนาได้ ซึ่งหมายความว่ามันสามารถสร้างคำตอบที่เฉพาะเจาะจงได้ โมเดลใช้เครื่องมือที่ประมวลผลสิ่งที่ได้พูดไปแล้วในระหว่างการสนทนาและเครื่องมือที่สร้างคำตอบตามบริบท โมเดลได้รับการฝึกอบรมจากข้อมูลที่เฉพาะเจาะจงและไม่เฉพาะเจาะจง ข้อมูลที่เฉพาะเจาะจงคือคำที่เกี่ยวข้องกับคำพูดก่อนหน้า ตามที่ Google อธิบาย

“ตัวอย่างเช่น หาก A พูดว่า ‘ฉันรักเทนนิส’ และ B ตอบว่า ‘นั่นเป็นเรื่องที่ดี’ แล้วคำพูดนั้นควรจะถูกทำเครื่องหมายว่า ‘ไม่เฉพาะเจาะจง’ คำตอบนั้นสามารถใช้ได้ในหลายๆ บริบทที่แตกต่างกัน แต่ถ้า B ตอบว่า ‘ฉันก็เช่นกัน ฉันไม่สามารถหยุดพูดถึงโรเจอร์ เฟเดอเรอร์ได้!’ แล้วคำตอบนั้นจะถูกทำเครื่องหมายว่า ‘เฉพาะเจาะจง’ เนื่องจากมันเกี่ยวข้องกับสิ่งที่กำลังพูดถึง

ข้อมูลที่ใช้ในการฝึกอบรมโมเดลประกอบด้วย ‘7 รอบ’ ของการสนทนา ในระหว่างการฝึกอบรม โมเดลมีพารามิเตอร์ 2.6 พันล้านตัวที่วิเคราะห์ข้อมูลข้อความ 341 GB เพื่อค้นหารูปแบบ ซึ่งเป็นชุดข้อมูลที่ใหญ่กว่าชุดข้อมูลที่ใช้ในการฝึกอบรมโมเดล GPT-2 ของ OpenAI ถึง 8.5 เท่า ตามที่ The Next Web รายงาน

Google รายงานว่า Meena ทำได้ดีเพียงใดที่มาตรฐาน Sensibleness และ Specificity Average (SSA) มาตรฐาน SSA เป็นมาตรฐานที่นักวิจัยของ Google สร้างขึ้นเพื่อวัดความสามารถของหน่วยงานสนทนาในการตอบสนองด้วยคำตอบที่เฉพาะเจาะจงและเกี่ยวข้องเมื่อการสนทนาเกิดขึ้น

คะแนน SSA จะถูกคำนวณโดยการทดสอบโมเดลกับคำสั่งหลายคำสั่ง และจำนวนคำตอบที่สมเหตุสมผลที่โมเดลให้จะถูกติดตาม คะแนนของโมเดลจะถูกกำหนดจากเปอร์เซ็นต์ของคำตอบที่สมเหตุสมผลและเฉพาะเจาะจงที่โมเดลสามารถให้ได้เมื่อเทียบกับคำสั่ง คำตอบที่เป็นแบบทั่วไปจะถูกปรับลดคะแนน ตามที่ Google ระบุ คะแนนเฉลี่ยของมนุษย์อยู่ที่ประมาณ 86% ในขณะที่ Meena สามารถทำคะแนนได้ 79% โมเดล AI ที่มีชื่อเสียงอีกตัวหนึ่งซึ่งสร้างโดย Pandora Bots ได้รับรางวัล Loebner Prize สำหรับการสื่อสารที่เหมือนมนุษย์ โมเดลของ Pandora Bots ได้คะแนนประมาณ 56% ในการทดสอบ SSA

Microsoft (MSFT ) และ Amazon ก็พยายามสร้าง โชตบอทที่ยืดหยุ่นและเป็นธรรมชาติมากขึ้นเช่นกัน Microsoft ได้พยายามสร้าง โชตบอทที่สามารถสนทนาได้หลายรอบเป็นเวลา 2 ปี โดยการซื้อกิจการ Semantic Machines ซึ่งเป็นสตาร์ทอัพ AI เพื่อปรับปรุง Cortana Amazon ได้จัดงาน Alexa Prize Challenge ล่าสุด ซึ่งเชิญชวนให้ผู้เข้าร่วมออกแบบ โชตบอทที่สามารถสนทนาได้ประมาณ 20 นาที

นักบล็อกและโปรแกรมเมอร์ที่มีความเชี่ยวชาญใน Machine Learning และ Deep Learning หัวข้อ Daniel หวังที่จะช่วยให้ผู้อื่นใช้พลังของ AI สำหรับสิ่งที่ดี