โมเดลและแพลตฟอร์ม AI

ทำไมแชทบอท AI มักจะเอาใจผู้ใช้

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

คุณกำลังจินตนาการหรือไม่ว่าแชทบอท AI ดูเหมือนจะเห็นด้วยกับคุณมากเกินไป ไม่ว่าจะเป็นการบอกว่าความคิดที่น่าสงสัยของคุณเป็น “ความคิดที่ยอดเยี่ยม” หรือการสนับสนุนคุณในเรื่องที่อาจเป็นเท็จ พฤติกรรมนี้ได้รับความสนใจทั่วโลก

เมื่อเร็วๆ นี้ OpenAI ติดหัวข่าวหลังจากผู้ใช้พบว่า ChatGPT มีพฤติกรรมเหมือนคนเห็นด้วยมากเกินไป การอัปเดตโมเดล 4o ทำให้บอทมีความสุภาพและเห็นด้วยมากเกินไป จนกระทั่งยินดี nóiอะไรเพื่อให้คุณพอใจ แม้ว่ามันจะเอนเอียงหรือไม่ถูกต้องก็ตาม

ทำไมระบบเหล่านี้จึงมักจะเอาใจผู้ใช้ และอะไรที่ทำให้พวกมันสะท้อนความคิดเห็นของคุณ คำถามเหล่านี้มีความสำคัญในการทำความเข้าใจว่าคุณสามารถใช้ AI ที่สร้างข้อความได้อย่างปลอดภัยและสนุกสนานยิ่งขึ้น

การอัปเดต ChatGPT ที่ไปไกลเกินไป

ในต้นปี 2025 ผู้ใช้ ChatGPT พบสิ่งแปลกๆ เกี่ยวกับโมเดลภาษาขนาดใหญ่ (LLM) มันเคยเป็นมิตร แต่เดี๋ยวนี้มันสุภาพมากเกินไป มันเริ่มเห็นด้วยกับทุกสิ่งทุกอย่าง ไม่ว่าจะเป็นคำสั่งที่แปลกหรือไม่ถูกต้องก็ตาม คุณอาจบอกว่าคุณไม่เห็นด้วยกับบางสิ่ง และมันจะตอบกลับด้วยความคิดเห็นเดียวกัน

การเปลี่ยนแปลงนี้เกิดขึ้นหลังจากการอัปเดตระบบที่มีจุดมุ่งหมายเพื่อให้ ChatGPT มีประโยชน์และมีการสนทนามากขึ้น อย่างไรก็ตาม ในการพยายามเพิ่มความพึงพอใจของผู้ใช้ โมเดลเริ่มให้ความสำคัญกับการเห็นด้วยมากเกินไป แทนที่จะให้คำตอบที่สมดุลหรือถูกต้อง มันเอนเอียงไปที่การยืนยัน

เมื่อผู้ใช้เริ่มแบ่งปันประสบการณ์ของตนเกี่ยวกับคำตอบที่เห็นด้วยมากเกินไปบนอินเทอร์เน็ต การตอบโต้เริ่มเกิดขึ้นอย่างรวดเร็ว ผู้วิจารณ์ AI เรียกว่าเป็นความล้มเหลวในการปรับโมเดล และ OpenAI ตอบสนองโดยการกลับไปที่ส่วนหนึ่งของการอัปเดตเพื่อแก้ไขปัญหา

ในโพสต์สาธารณะ บริษัท ยอมรับว่า GPT-4o มีพฤติกรรมเหมือนคนเห็นด้วย และสัญญาว่าจะปรับเปลี่ยนเพื่อลดพฤติกรรมนี้ มันเป็นการเตือนให้เห็นว่าความตั้งใจที่ดีในการออกแบบ AI อาจไปในทางที่ผิด และผู้ใช้จะสังเกตเห็นเมื่อมันเริ่มไม่จริงใจ

ทำไมแชทบอท AI จึงเอาใจผู้ใช้

พฤติกรรมเหมือนคนเห็นด้วยเป็นสิ่งที่นักวิจัยสังเกตเห็นในแชทบอท AI หลายตัว การศึกษาที่ตีพิมพ์บน arXiv พบว่าพฤติกรรมเหมือนคนเห็นด้วยเป็นรูปแบบที่แพร่หลาย การวิเคราะห์เผยให้เห็นว่า โมเดล AI จากผู้ให้บริการชั้นนำ 5 ราย เห็นด้วยกับผู้ใช้อย่างต่อเนื่อง แม้ว่าจะนำไปสู่คำตอบที่ไม่ถูกต้องก็ตาม ระบบเหล่านี้มักจะยอมรับความผิดพลาดเมื่อคุณถาม และส่งผลให้เกิดการให้ข้อมูลที่เอนเอียงและซ้ำๆ

แชทบอทเหล่านี้ถูกฝึกให้เห็นด้วยกับคุณ แม้ว่าคุณจะผิดก็ตาม ทำไมจึงเกิดขึ้น คำตอบสั้นๆ คือว่าผู้พัฒนาได้สร้าง AI เพื่อให้มีประโยชน์ แต่ความมีประโยชน์นั้นขึ้นอยู่กับการฝึกที่ให้ความสำคัญกับการให้ข้อมูลที่ผู้ใช้พึงพอใจ ผ่านวิธีการเรียนรู้แบบเสริมกำลังด้วยข้อมูลจากมนุษย์ (RLHF) โมเดลเหล่านี้เรียนรู้เพื่อเพิ่มประสิทธิภาพของคำตอบ ที่มนุษย์พบว่าน่าพึงพอใจ แต่ปัญหาก็คือ การให้ข้อมูลที่น่าพึงพอใจไม่ได้หมายความว่าข้อมูลนั้นถูกต้องเสมอไป

เมื่อโมเดล AI รู้สึกว่าคุณกำลังมองหาคำตอบที่เฉพาะเจาะจง มันจะเอนเอียงไปที่การเห็นด้วยกับคุณ นั่นหมายความว่ามันจะยืนยันความคิดเห็นของคุณหรือการอ้างสิทธิ์ที่เป็นเท็จเพื่อรักษาความสนทนาให้ดำเนินต่อไป

ยังมีผลการสะท้อนอีกด้วย แชทบอท AI สะท้อนโทน สถาปัตยกรรม และตรรกะของข้อมูลที่ได้รับ หากคุณดูเหมือนมั่นใจ บอทก็มีแนวโน้มที่จะดูเหมือนมั่นใจเช่นกัน นั่นไม่ใช่โมเดลที่คิดว่าคุณถูกต้อง แต่เป็นการทำหน้าที่ในการรักษาความสนทนาให้ดูเป็นมิตรและดูเหมือนมีประโยชน์

แม้ว่ามันอาจดูเหมือนแชทบอทของคุณเป็นระบบสนับสนุน แต่มันอาจเป็นการสะท้อนถึงการฝึกอบรมที่มุ่งให้ความพึงพอใจมากกว่าการผลักดันให้คุณคิดอย่างมีวิจารณญาณ

ปัญหาเกี่ยวกับ AI ที่เหมือนคนเห็นด้วย

มันอาจดูเหมือนเป็นเรื่องไม่มีอะไรน่าห่วงเมื่อแชทบอทเห็นด้วยกับทุกสิ่งทุกอย่างที่คุณพูด แต่พฤติกรรม AI ที่เหมือนคนเห็นด้วยมีผลเสีย โดยเฉพาะอย่างยิ่งเมื่อระบบเหล่านี้ถูกใช้กันอย่างแพร่หลาย

ข้อมูลที่ไม่ถูกต้องได้รับการผ่านพิจารณา

ความถูกต้องเป็นหนึ่งในปัญหาใหญ่ที่สุด เมื่อแชทบอท AI ยืนยันคำกล่าวที่เป็นเท็จหรือเอนเอียง มันเสี่ยงต่อการยืนยันความเข้าใจผิดแทนการแก้ไขพวกมัน สิ่งนี้กลายเป็นเรื่องอันตรายโดยเฉพาะอย่างยิ่งเมื่อคุณกำลังมองหาคำแนะนำเกี่ยวกับหัวข้อที่สำคัญ เช่น สุขภาพ การเงิน หรือเหตุการณ์ปัจจุบัน หาก LLM ให้ความสำคัญกับการเห็นด้วยมากกว่าความจริง ผู้คนอาจออกไปพร้อมกับข้อมูลที่ไม่ถูกต้องและแพร่กระจายมัน

ไม่มีพื้นที่สำหรับการคิดอย่างมีวิจารณญาณ

สิ่งหนึ่งที่ทำให้ AI น่าสนใจคือศักยภาพในการกระทำเหมือนคู่คิด — เพื่อท้าทายสมมติฐานของคุณหรือช่วยให้คุณเรียนรู้สิ่งใหม่ๆ อย่างไรก็ตาม เมื่อแชทบอทเห็นด้วยกับคุณเสมอ คุณจะมีพื้นที่น้อยในการคิด เมื่อมันสะท้อนความคิดของคุณตามเวลา มันสามารถทำให้การคิดอย่างมีวิจารณญาณดูไม่คมชัดลงแทนการทำให้มันคมชัดขึ้น

ไม่สนใจชีวิตมนุษย์

พฤติกรรมที่เหมือนคนเห็นด้วยเป็นมากกว่าความน่ารำคาญ — มันเป็นอันตราย หากคุณถามแชทบอท AI เกี่ยวกับการให้คำแนะนำทางการแพทย์และมันตอบกลับด้วยการเห็นด้วยมากกว่าการให้คำแนะนำที่มีหลักฐาน มันอาจนำไปสู่การวินิจฉัยที่ไม่ถูกต้องหรือการรักษาที่ล่าช้า ซึ่งอาจมีผลกระทบอย่างรุนแรง

ตัวอย่างเช่น สมมติว่าคุณเข้าไปที่แพลตฟอร์มการให้คำปรึกษาทางการแพทย์ที่ใช้แชทบอท AI หลังจากอธิบายอาการและคุณสงสัยว่าเกิดอะไรขึ้น บอทอาจยืนยันการวินิจฉัยด้วยตนเองของคุณหรือลดความสำคัญของอาการของคุณ สิ่งนี้อาจนำไปสู่การวินิจฉัยที่ไม่ถูกต้องหรือการรักษาที่ล่าช้า ซึ่งอาจมีผลกระทบอย่างรุนแรง

ผู้ใช้มากขึ้นและความเข้าถึงแบบเปิดทำให้ยากต่อการควบคุม

เมื่อแพลตฟอร์มเหล่านี้กลายเป็นส่วนหนึ่งของชีวิตประจำวันมากขึ้น ความเสี่ยงของพวกมันก็เพิ่มขึ้น ChatGPT เพียงอย่างเดียวตอนนี้ ให้บริการผู้ใช้ 1 พันล้านคน ทุกสัปดาห์ ดังนั้น ความเอนเอียงและรูปแบบที่เห็นด้วยมากเกินไปสามารถแพร่กระจายไปยังผู้ชมจำนวนมาก

นอกจากนี้ ความกังวลนี้ยังเพิ่มขึ้นเมื่อคุณพิจารณาว่า AI กำลังเปิดให้เข้าถึงได้ง่ายขึ้นผ่านแพลตฟอร์มที่เปิดกว้าง ตัวอย่างเช่น DeepSeek AI ช่วยให้ใครก็ตามสามารถปรับแต่งและสร้างบนโมเดล LLM ได้ฟรี

แม้ว่าการสร้างนวัตกรรมแบบเปิดจะมีความน่าตื่นเต้น แต่ก็หมายความว่ามีการควบคุมพฤติกรรมของระบบเหล่านี้น้อยลงในมือของนักพัฒนาที่ไม่มีการดูแลอย่างเหมาะสม โดยไม่มีการกำกับดูแลที่เหมาะสม ผู้คนเสี่ยงต่อการเห็นพฤติกรรมที่เหมือนคนเห็นด้วยที่เพิ่มขึ้นในลักษณะที่ยากต่อการติดตาม ไม่ต้องพูดถึงการแก้ไข

วิธีที่นักพัฒนา OpenAI พยายามแก้ไขปัญหา

หลังจากกลับไปที่การอัปเดตที่ทำให้ ChatGPT เป็นคนเห็นด้วยมากเกินไป OpenAI สัญญาว่าจะแก้ไขปัญหา มันพยายามแก้ไขปัญหานี้ผ่านวิธีการหลักๆ ดังนี้

  • การปรับเปลี่ยนการฝึกอบรมหลักและคำสั่งระบบ: นักพัฒนากำลังปรับเปลี่ยนการฝึกอบรมและคำสั่งโมเดลด้วยคำแนะนำที่ชัดเจนยิ่งขึ้น ซึ่งผลักดันโมเดลไปสู่ความจริงมากกว่าการเห็นด้วยอัตโนมัติ
  • การเพิ่มการป้องกันที่แข็งแกร่งสำหรับความซื่อสัตย์และความโปร่งใส: OpenAI กำลังเพิ่มการป้องกันระดับระบบเพื่อให้แน่ใจว่าแชทบอทยึดมั่นในข้อมูลที่เชื่อถือได้และถูกต้อง
  • การขยายความพยายามในการวิจัยและการประเมิน: บริษัทกำลังศึกษาสิ่งที่ทำให้เกิดพฤติกรรมนี้และวิธีการป้องกันในโมเดลอนาคต
  • การให้ผู้ใช้เข้ามามีส่วนร่วมตั้งแต่เนิ่นๆ: มันกำลังสร้างโอกาสให้ผู้ใช้ทดสอบโมเดลและให้ข้อเสนอแนะก่อนที่การอัปเดตจะออกสู่สาธารณะ ซึ่งช่วยให้พบปัญหาเช่นการเห็นด้วยมากเกินไปในระยะแรก

สิ่งที่ผู้ใช้สามารถทำได้เพื่อหลีกเลี่ยง AI ที่เหมือนคนเห็นด้วย

ในขณะที่นักพัฒนากำลังทำงานเบื้องหลังเพื่อปรับและปรับแต่งโมเดลเหล่านี้ คุณสามารถช่วยกำหนดว่าแชทบอทจะตอบสนองอย่างไรได้ วิธีที่ง่ายแต่มีประสิทธิภาพในการส่งเสริมการโต้ตอบที่สมดุลมากขึ้น ได้แก่

  • การใช้คำสั่งแบบเปิดและเป็นกลาง: แทนที่จะเขียนคำสั่งของคุณในลักษณะที่ขอความเห็นด้วย พยายามใช้คำถามที่เปิดกว้างเพื่อให้บอทรู้สึกน้อยกว่าที่จะเห็นด้วย
  • ขอความเห็นที่หลากหลาย: ลองใช้คำสั่งที่ขอความเห็นทั้งสองด้านของการถกเถียง ซึ่งบอกโมเดลว่าคุณกำลังมองหาสมดุลมากกว่าการเห็นด้วย
  • ท้าทายคำตอบ: หากสิ่งใดดูเหมือนจะให้ความสำคัญกับการเห็นด้วยหรือเรียบง่ายเกินไป ติดตามด้วยการขอการตรวจสอบข้อเท็จจริงหรือมุมมองที่ตรงกันข้าม ซึ่งสามารถผลักดันโมเดลไปสู่คำตอบที่ซับซ้อนมากขึ้น
  • ใช้ปุ่มให้คำตอบดีหรือไม่ดี: การให้ข้อเสนอแนะเป็นสิ่งสำคัญ การคลิก “ไม่ดี” ในคำตอบที่เห็นด้วยมากเกินไปช่วยให้นักพัฒนาสามารถระบุและปรับเปลี่ยนรูปแบบเหล่านั้น
  • ตั้งค่าคำสั่งแบบกำหนดเอง: ChatGPT อนุญาตให้ผู้ใช้ปรับแต่งวิธีการตอบสนองได้ คุณสามารถปรับโทนให้เป็นทางการหรือไม่ทางการตามที่คุณต้องการ คุณอาจขอให้มันให้คำตอบที่เป็นกลาง มีรายละเอียด หรือมีความกังขา หากคุณไปที่การตั้งค่า > คำสั่งแบบกำหนดเอง คุณสามารถบอกโมเดลได้ว่าคุณชอบบุคลิกภาพหรือแนวทางใด

การให้ความจริงมากกว่าการให้คำตอบดี

แชทบอท AI ที่เหมือนคนเห็นด้วยอาจเป็นปัญหา แต่มีข่าวดีว่ามันสามารถแก้ไขได้ นักพัฒนากำลังดำเนินการเพื่อนำโมเดลเหล่านี้ไปสู่พฤติกรรมที่เหมาะสมยิ่งขึ้น หากคุณสังเกตเห็นว่าแชทบอทของคุณพยายามที่จะทำให้คุณพอใจมากเกินไป ลองใช้ขั้นตอนเหล่านี้เพื่อทำให้มันกลายเป็นเพื่อนร่วมงานที่ฉลาดที่คุณสามารถพึ่งพาได้

Zac Amos เป็นนักเขียนด้านเทคโนโลยีที่มุ่งเน้นไปที่ปัญญาประดิษฐ์ เขายังเป็น Features Editor ที่ ReHack ซึ่งคุณสามารถอ่านงานของเขาเพิ่มเติม