โมเดลและแพลตฟอร์ม AI

วงจรป้อนกลับของ AI: การรักษาคุณภาพการผลิตแบบจำลองในยุคของเนื้อหาที่สร้างโดย AI

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

แบบจำลอง AI ที่ติดตั้งการผลิตต้องการกลไกการประเมินประสิทธิภาพที่มีความแข็งแกร่งและต่อเนื่อง นี่คือจุดที่วงจรป้อนกลับของ AI สามารถนำมาใช้เพื่อให้แน่ใจว่าแบบจำลองมีการทำงานที่สม่ำเสมอ

ลองฟังคำพูดของ Elon Musk:

“ฉันคิดว่ามันสำคัญมากที่จะมีวงจรป้อนกลับ ซึ่งคุณคิดอยู่เสมอว่าคุณทำอะไรและคุณสามารถทำมันได้ดีขึ้นอย่างไร”

สำหรับแบบจำลอง AI ทั้งหมด ขั้นตอนมาตรฐานคือการนำแบบจำลองไปใช้และทดสอบใหม่บ่อยๆ โดยใช้ข้อมูลจากโลกแห่งความเป็นจริงล่าสุดเพื่อให้แน่ใจว่าประสิทธิภาพของแบบจำลองไม่ลดลง แต่ด้วยการเพิ่มขึ้นอย่างรวดเร็วของ Generative AI การฝึกอบรมแบบจำลอง AI ได้กลายเป็นเรื่องที่ผิดปกติและเต็มไปด้วยข้อผิดพลาด นั่นเป็นเพราะแหล่งข้อมูลออนไลน์ (อินเทอร์เน็ต) กำลังจะกลายเป็น混合ของข้อมูลที่สร้างโดยมนุษย์และ AI

ตัวอย่างเช่น บล็อกหลายแห่งในปัจจุบันมีข้อความที่สร้างโดย AI โดยใช้ LLMs (Large Language Modules) เช่น ChatGPT หรือ GPT-4 นอกจากนี้ นักวิจัย AI ยังใช้ข้อมูลสังเคราะห์ที่สร้างโดย Generative AI ในการฝึกอบรมแบบจำลองของตน

ดังนั้น เราจึงต้องการกลไกที่มีความแข็งแกร่งเพื่อให้แน่ใจว่าคุณภาพของแบบจำลอง AI นี่คือจุดที่ความต้องการวงจรป้อนกลับของ AI ได้เพิ่มขึ้น

วงจรป้อนกลับของ AI คืออะไร?

วงจรป้อนกลับของ AI คือกระบวนการที่ซ้ำๆ กัน โดยที่การตัดสินใจและผลลัพธ์ของแบบจำลอง AI จะถูกเก็บและใช้เพื่อปรับปรุงหรือฝึกอบรมแบบจำลองใหม่ ซึ่งนำไปสู่การเรียนรู้ การพัฒนา และการปรับปรุงแบบจำลองอย่างต่อเนื่อง ในกระบวนงนี้ ข้อมูลฝึกอบรม แบบจำลอง และอัลกอริทึมจะถูกปรับปรุงและพัฒนาโดยอาศัยข้อมูลที่สร้างขึ้นภายในระบบ

โดยทั่วไป มีสองประเภทของวงจรป้อนกลับของ AI:

  1. วงจรป้อนกลับของ AI ที่เป็นบวก: เมื่อแบบจำลอง AI สร้างผลลัพธ์ที่ถูกต้องซึ่งสอดคล้องกับความคาดหวังและความชอบของผู้ใช้ ผู้ใช้จะให้ข้อเสนอแนะที่เป็นบวกผ่านวงจรป้อนกลับ ซึ่งจะเสริมสร้างความถูกต้องของผลลัพธ์ในอนาคต
  2. วงจรป้อนกลับของ AI ที่เป็นลบ: เมื่อแบบจำลอง AI สร้างผลลัพธ์ที่ไม่ถูกต้อง ผู้ใช้จะรายงานข้อผิดพลาดผ่านวงจรป้อนกลับ ซึ่งจะพยายามปรับปรุงความเสถียรของระบบโดยการแก้ไขข้อผิดพลาด

ทั้งสองประเภทของวงจรป้อนกลับของ AI ช่วยให้แบบจำลอง AI มีการพัฒนาและปรับปรุงประสิทธิภาพอย่างต่อเนื่อง และไม่ได้ใช้หรือนำไปใช้ในลักษณะที่แยกจากกัน แต่จะช่วยให้แบบจำลอง AI ที่ติดตั้งการผลิตสามารถรู้ว่าอะไรถูกต้องหรือผิด

ขั้นตอนของวงจรป้อนกลับของ AI

An Illustration of AI-generated data in AI feedback loop

ภาพประกอบของกลไกป้อนกลับในแบบจำลอง AI แหล่งที่มา

การเข้าใจว่าวงจรป้อนกลับของ AI ทำงานอย่างไรเป็นสิ่งสำคัญในการปลดปล่อยศักยภาพเต็มที่ของการพัฒนา AI มาดูกันว่าขั้นตอนของวงจรป้อนกลับของ AI คืออะไร

  1. การรวบรวมข้อเสนอแนะ: รวบรวมผลลัพธ์ของแบบจำลองที่เกี่ยวข้องเพื่อประเมินผล โดยทั่วไป ผู้ใช้จะให้ข้อเสนอแนะเกี่ยวกับผลลัพธ์ของแบบจำลอง ซึ่งจะถูกใช้ในการฝึกอบรมใหม่ หรืออาจเป็นข้อมูลจากเว็บที่ถูกเลือกมาเพื่อปรับปรุงประสิทธิภาพของระบบ
  2. การฝึกอบรมแบบจำลองใหม่: โดยใช้ข้อมูลที่รวบรวมมา แบบจำลอง AI จะถูกฝึกอบรมใหม่เพื่อให้สามารถทำนายผลลัพธ์ที่ดีขึ้น โดยการปรับปรุงพารามิเตอร์ของแบบจำลองหรือน้ำหนัก
  3. การผสมผสานและทดสอบข้อเสนอแนะ: หลังจากการฝึกอบรมใหม่ แบบจำลองจะถูกทดสอบและประเมินผลอีกครั้ง ในขั้นตอนนี้ ข้อเสนอแนะจากผู้เชี่ยวชาญจะถูกรวมเข้าด้วยเพื่อเน้นย้ำปัญหาเกินข้อมูล
  4. การนำไปใช้: แบบจำลองจะถูกนำไปใช้ใหม่หลังจากการตรวจสอบการเปลี่ยนแปลง ในขั้นตอนนี้ แบบจำลองควรแสดงผลลัพธ์ที่ดีขึ้นในข้อมูลจากโลกแห่งความเป็นจริงใหม่ ซึ่งจะนำไปสู่ประสบการณ์ของผู้ใช้ที่ดีขึ้น
  5. การตรวจสอบ: แบบจำลองจะถูกตรวจสอบอย่างต่อเนื่องโดยใช้เมตริกเพื่อระบุปัญหาเช่น การเปลี่ยนแปลงของข้อมูล และวงจรป้อนกลับจะดำเนินต่อไป

ปัญหาในข้อมูลการผลิตและผลลัพธ์ของแบบจำลอง AI

การสร้างระบบ AI ที่มีความแข็งแกร่งต้องการความเข้าใจที่ลึกซึ้งเกี่ยวกับปัญหาในข้อมูลการผลิต (ข้อมูลจากโลกแห่งความเป็นจริง) และผลลัพธ์ของแบบจำลอง มาดูกันว่าปัญหาใดที่กลายเป็นอุปสรรคในการรับรองความถูกต้องและความน่าเชื่อถือของระบบ AI:

  1. การเปลี่ยนแปลงของข้อมูล: เกิดขึ้นเมื่อแบบจำลองเริ่มรับข้อมูลจากโลกแห่งความเป็นจริงที่มีการกระจายต่างจากข้อมูลฝึกอบรม
  2. การเปลี่ยนแปลงของแบบจำลอง: ความสามารถในการทำนายและประสิทธิภาพของแบบจำลองลดลงเมื่อเวลาผ่านไปเนื่องจากสภาพแวดล้อมของโลกแห่งความเป็นจริงที่เปลี่ยนแปลง
  3. ผลลัพธ์ของแบบจำลอง AI เทียบกับการตัดสินใจในโลกแห่งความเป็นจริง: แบบจำลอง AI สร้างผลลัพธ์ที่ไม่ถูกต้องซึ่งไม่สอดคล้องกับการตัดสินใจของฝ่ายต่างๆ ในโลกแห่งความเป็นจริง
  4. ความลำเอียงและความยุติธรรม: แบบจำลอง AI สามารถพัฒนาเป็นความลำเอียงและความยุติธรรมได้ ตัวอย่างเช่น ใน การบรรยาย TED โดย Janelle Shane เธออธิบายว่า Amazon (AMZN ) ต้องหยุดพัฒนาแอลกอริทึมการจัดเรียงเรซูเม่เนื่องจากการเลือกปฏิบัติตามเพศ

เมื่อแบบจำลอง AI เริ่มฝึกอบรมด้วยเนื้อหาที่สร้างโดย AI ปัญหาเหล่านี้สามารถเพิ่มขึ้นได้ มาดูกันว่าทำไม

วงจรป้อนกลับของ AI ในยุคของเนื้อหาที่สร้างโดย AI

ในยุคของการนำ Generative AI ไปใช้อย่างรวดเร็ว นักวิจัยได้ศึกษาพื้นฐานของ Model Collapse ซึ่งถูกกำหนดไว้ว่าเป็น

“กระบวนการเสื่อมสภาพที่ส่งผลต่อการเรียนรู้ของแบบจำลอง AI ที่สร้างขึ้น ซึ่งข้อมูลที่สร้างขึ้นจะทำให้แบบจำลองในยุคต่อไปๆ สูญเสียความสามารถในการรับรู้ความเป็นจริง”

Model Collapse มีสองกรณีพิเศษ

  • การเสื่อมสภาพแบบจำลองในระยะแรก: เกิดขึ้นเมื่อ “แบบจำลองเริ่มสูญเสียข้อมูลเกี่ยวกับขอบเขตของการกระจายตัว” หรือส่วนปลายของการกระจายตัวฝึกอบรม
  • การเสื่อมสภาพแบบจำลองในระยะหลัง: เกิดขึ้นเมื่อ “แบบจำลองรวมโหมดต่างๆ ของการกระจายตัวเดิมและลู่เข้าสู่การกระจายตัวที่มีลักษณะคล้ายกัน แต่มีความแปรผันเล็กน้อย”

สาเหตุของการเสื่อมสภาพแบบจำลอง

สำหรับผู้ปฏิบัติงาน AI ที่ต้องการแก้ไขปัญหานี้ จำเป็นต้องเข้าใจสาเหตุของการเสื่อมสภาพแบบจำลอง ซึ่งแบ่งออกเป็นสองประเภทหลัก:

  1. ข้อผิดพลาดในการประมาณค่าทางสถิติ: ข้อผิดพลาดนี้เกิดจากจำนวน样本ที่จำกัด และจะหายไปเมื่อจำนวน样本เข้าใกล้อนันต์
  2. ข้อผิดพลาดในการประมาณค่าแบบฟังก์ชัน: ข้อผิดพลาดนี้เกิดขึ้นเมื่อแบบจำลอง เช่น โครงข่ายประสาทเทียม ไม่สามารถจับฟังก์ชันพื้นฐานที่ต้องเรียนรู้จากข้อมูลได้
Causes Of Model Collapse-Example

ตัวอย่างผลลัพธ์ของแบบจำลองสำหรับหลายรุ่นของแบบจำลองที่ได้รับผลกระทบจาก Model Collapse แหล่งที่มา

วงจรป้อนกลับของ AI ได้รับผลกระทบอย่างไรจากเนื้อหาที่สร้างโดย AI

เมื่อแบบจำลอง AI ฝึกอบรมด้วยเนื้อหาที่สร้างโดย AI จะส่งผลเสียต่อวงจรป้อนกลับของ AI และอาจทำให้เกิดปัญหาหลายอย่าง เช่น

  • การเสื่อมสภาพแบบจำลอง: การเสื่อมสภาพแบบจำลองเป็นเรื่องที่น่าจะเกิดขึ้นหากวงจรป้อนกลับของ AI มีเนื้อหาที่สร้างโดย AI
  • การลืมอย่างรุนแรง: ปัญหาหนึ่งในการเรียนรู้อย่างต่อเนื่องคือแบบจำลองลืมตัวอย่างเก่าเมื่อเรียนรู้ข้อมูลใหม่ ซึ่งเรียกว่าการลืมอย่างรุนแรง
  • การปนเปื้อนของข้อมูล: การปนเปื้อนของข้อมูลหมายถึงการให้ข้อมูลสังเคราะห์ที่ถูกจัดการเข้าไปในแบบจำลอง AI เพื่อทำให้ประสิทธิภาพลดลงและทำให้สร้างผลลัพธ์ที่ไม่ถูกต้อง

ธุรกิจสามารถสร้างวงจรป้อนกลับที่มีความแข็งแกร่งสำหรับแบบจำลอง AI ของตนได้อย่างไร

ธุรกิจสามารถได้รับประโยชน์จากการใช้วงจรป้อนกลับในกระบวนการทำงาน AI ของตน ต่อไปนี้คือขั้นตอนหลักๆ ที่ธุรกิจสามารถทำได้เพื่อปรับปรุงประสิทธิภาพของแบบจำลอง AI:

  • ข้อเสนอแนะจากผู้เชี่ยวชาญ: ผู้เชี่ยวชาญมีความรู้ที่ลึกซึ้งเกี่ยวกับการใช้แบบจำลอง AI และสามารถให้ข้อเสนอแนะเพื่อเพิ่มความสอดคล้องของแบบจำลองกับสภาพแวดล้อมของโลกแห่งความเป็นจริงได้
  • การเลือกเมตริกคุณภาพแบบจำลองที่เหมาะสม: การเลือกเมตริกที่เหมาะสมสำหรับงานและติดตามแบบจำลองในกระบวนการผลิตตามเมตริกเหล่านั้นสามารถรับรองคุณภาพของแบบจำลองได้ นักพัฒนา AI ยังใช้เครื่องมือ MLOps สำหรับการประเมินและติดตามอัตโนมัติเพื่อเตือนผู้มีส่วนได้ส่วนเสียหากประสิทธิภาพของแบบจำลองเริ่มลดลงในกระบวนการผลิต
  • การคัดเลือกข้อมูลอย่างเข้มงวด: เมื่อแบบจำลองในกระบวนการผลิตถูกฝึกอบรมใหม่ด้วยข้อมูลใหม่ๆ มันสามารถลืมข้อมูลในอดีตได้ ดังนั้นจึงจำเป็นต้องคัดเลือกข้อมูลที่มีคุณภาพสูงซึ่งสอดคล้องกับวัตถุประสงค์ของแบบจำลอง ข้อมูลนี้สามารถใช้ในการฝึกอบรมแบบจำลองใหม่ในยุคต่อไปๆ ร่วมกับข้อเสนอแนะของผู้ใช้เพื่อให้แน่ใจว่าคุณภาพ

เพื่อเรียนรู้เพิ่มเติมเกี่ยวกับการพัฒนาของ AI ไปที่ Unite.ai

Haziqa เป็นนักวิทยาศาสตร์ข้อมูลที่มีประสบการณ์อย่างกว้างขวางในการเขียนเนื้อหาทางเทคนิคสำหรับบริษัท AI และ SaaS