มุมมองของ Anderson

การพลิกผัน 180 องศาที่เห็นได้ชัดในความเอนเอียงในการจ้างงานของ AI ตั้งแต่ปี 2024

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google
AI-generated image (GPT-2): a photorealistic visualization of a humanoid industrial robot evaluating a room of anxious job applicants, illustrating the paper's exploration of demographic bias in AI-assisted hiring. The warning border indicates that the scene is fictional and not a depiction of events described in the research.

การวิจัยใหม่ๆ เสนอว่า ความเอนเอียงในการจ้างงานของระบบ AI ได้พลิกผันไปในทิศทางตรงกันข้ามในช่วงสามปีที่ผ่านมา : ในหมู่ 14 โมเดล AI ชั้นนำที่ศึกษา พบว่าโมเดลใหม่ๆ เกือบทั้งหมดชื่นชอบผู้สมัครที่เป็นชาวแอฟริกันอเมริกันและ/หรือผู้หญิง ซึ่งเป็นข้อขัดแย้งกับตำแหน่งเฉลี่ยของพวกเขาในปี 2023

 

ในการตรวจสอบ 14 โมเดล AI ชั้นนำ最近 รวมถึงหลายเวอร์ชันของ ChatGPT, Claude, Gemini, Llama, Grok และ Qwen นักวิจัยพบว่า ความเอนเอียงในการจ้างงานของ AI ดูเหมือนจะพลิกผันหลังปี 2023 โดยมีโมเดลใหม่ๆ ที่ชื่นชอบผู้สมัครที่เป็นชาวแอฟริกันอเมริกันและผู้หญิง มากกว่าผู้สมัครที่เป็นชายผิวขาวที่เคยได้รับประโยชน์มาก่อน

แผนภูมิแสดงช่องว่างการเรียกคืนตามเชื้อชาติสำหรับแต่ละโมเดล AI เรียงตามวันที่เผยแพร่ GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครผิวขาวที่พบในงานวิจัยของมนุษย์ ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเชื้อชาติที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครผิวดำ

แผนภูมิแสดงช่องว่างการเรียกคืนตามเชื้อชาติสำหรับแต่ละโมเดล AI เรียงตามวันที่เผยแพร่ GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครผิวขาวที่พบในงานวิจัยของมนุษย์ ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเชื้อชาติที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครผิวดำ แหล่งที่มา

นอกจากนี้ รูปแบบเดียวกันยังปรากฏสำหรับเพศ : โมเดล GPT-3.5-Turbo ของ OpenAI ในปี 2023 ชื่นชอบผู้สมัครชาย ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเพศที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครหญิง

แผนภูมิแสดงช่องว่างการเรียกคืนตามเพศสำหรับ 13 โมเดล AI ไม่เหมือนกับ GPT-3.5 ที่ชื่นชอบผู้สมัครชาย โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป มีการเปลี่ยนแปลงไปสู่ความเป็นกลางหรือชื่นชอบผู้สมัครหญิง

แผนภูมิแสดงช่องว่างการเรียกคืนตามเพศสำหรับ 13 โมเดล AI ไม่เหมือนกับ GPT-3.5 ที่ชื่นชอบผู้สมัครชาย โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป มีการเปลี่ยนแปลงไปสู่ความเป็นกลางหรือชื่นชอบผู้สมัครหญิง

การเปลี่ยนแปลงนี้อาจสะท้อนถึงการเปลี่ยนแปลงที่ผู้พัฒนา AI ได้ทำเพื่อตอบสนองต่อคำวิจารณ์เกี่ยวกับความเอนเอียงทางประชากรของ AI โดยมีโมเดลใหม่ๆ ที่ดูเหมือนจะถูกฝึกฝนใหม่หรือปรับให้เหมาะสมเพื่อลดความเอนเอียงในการจ้างงาน

วิธีการ

การศึกษานี้ใช้วิธีการที่พัฒนาไว้สำหรับงานวิจัยในปี 2022 เรื่อง การแบ่งแยกทางระบบในบรรดาบริษัทใหญ่ของสหรัฐฯ (หรือที่เรียกว่า ‘Klein, Rose และ Walters’ หรือ ‘kline2022systemic’)

ในงานวิจัยก่อนหน้านี้ นักวิจัยได้ส่งใบสมัครงานปลอมมากกว่า 83,000 ใบไปยัง 108 ของบริษัทใหญ่ที่สุดในสหรัฐฯ โดยใช้ใบสมัครที่ตรงกันซึ่งมีชื่อที่บ่งบอกถึงเชื้อชาติและเพศที่แตกต่างกัน ในขณะที่คุณสมบัติอื่นๆ เหมือนกัน การศึกษานี้พบว่ามีการเรียกคืนผู้สมัครที่ชื่นชอบผู้สมัครที่มีชื่อผิวขาว

การศึกษานี้ใช้โครงสร้างการตรวจสอบที่คล้ายกันสำหรับ AI โดยใช้ 6,007 โฆษณางานที่เปิดให้สมัครในระดับเริ่มต้นในสหรัฐฯ ที่ตรงกับการกระจายของบริษัทที่ใช้ในการศึกษาก่อนหน้านี้ นักวิจัยได้สร้างคู่ของใบสมัครที่เหมือนกันซึ่งแตกต่างกันเฉพาะในเรื่องของเชื้อชาติหรือเพศที่บ่งบอกโดยชื่อของผู้สมัคร

โมเดลที่ถูกตรวจสอบ ได้แก่ GPT-3.5-Turbo, GPT-4o-mini, GPT-oss-120b และ GPT-5.4-mini ของ OpenAI; Claude 3 Haiku และ Claude Haiku 4.5 ของ Anthropic; Llama-3.1-8B และ Llama-3.3-70B ของ Meta; Gemini-2.5-flash และ Gemma-4-31B ของ Google; Grok-4.1-fast ของ xAI; DeepSeek-V3.1 ของ DeepSeek; Qwen3.5-397B ของ Alibaba และ GLM-5.1 ของ Zhipu AI

ผลลัพธ์

เชื้อชาติ

ตารางผลลัพธ์ด้านล่างสรุปผลการวิจัยเกี่ยวกับการแบ่งแยกทางเชื้อชาติสำหรับ 14 โมเดล AI ที่เรียงตามวันที่เผยแพร่

ตารางผลลัพธ์เกี่ยวกับการแบ่งแยกทางเชื้อชาติสำหรับ 14 โมเดล AI เรียงตามวันที่เผยแพร่ GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครผิวขาว ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเชื้อชาติที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครผิวดำ

ตารางผลลัพธ์เกี่ยวกับการแบ่งแยกทางเชื้อชาติสำหรับ 14 โมเดล AI เรียงตามวันที่เผยแพร่ GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครผิวขาว ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเชื้อชาติที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครผิวดำ

ผลลัพธ์แสดงให้เห็นว่ามีการเปลี่ยนแปลงที่ชัดเจนตามเวลา โดย GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครผิวขาว ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเชื้อชาติที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครผิวดำ

เพศ

ตารางผลลัพธ์ด้านล่างสรุปผลการวิจัยเกี่ยวกับการแบ่งแยกทางเพศสำหรับ 13 โมเดล AI ที่เรียงตามวันที่เผยแพร่

ตารางผลลัพธ์เกี่ยวกับการแบ่งแยกทางเพศสำหรับ 13 โมเดล AI เรียงตามวันที่เผยแพร่ GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครชาย ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเพศที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครหญิง

ตารางผลลัพธ์เกี่ยวกับการแบ่งแยกทางเพศสำหรับ 13 โมเดล AI เรียงตามวันที่เผยแพร่ GPT-3.5-Turbo ส่งผลให้เกิดความเอนเอียงในการจ้างงานที่ชื่นชอบผู้สมัครชาย ในขณะที่โมเดลที่เผยแพร่ตั้งแต่ปี 2024 เป็นต้นไป ไม่แสดงความชื่นชอบเพศที่มีนัยสำคัญทางสถิติหรือชื่นชอบผู้สมัครหญิง

สรุป

อาจเป็นเรื่องที่น่ากังวลที่สุดว่าการทำให้ AI มีความเอนเอียงในการจ้างงานตามที่ต้องการอาจเป็นการ “ยินยอม” ที่ไม่เต็มใจ เช่นเดียวกับบุคคลที่มีความคิดเห็นที่ไม่เหมาะสมที่ถูกบังคับให้หยุดเผยแพร่ความคิดเห็นของตนบนโซเชียลมีเดีย แต่ยังคงรักษาความคิดเห็นของตนไว้

การวิจัยล่าสุดอื่นๆ ได้แนะนำว่า AI ไม่ได้ทำการตัดสินใจโดยการรวบรวมข้อมูลและพิจารณา แต่ทำการตัดสินใจโดยอาศัยข้อมูลที่มีอยู่ในข้อมูลการฝึก ซึ่งหมายความว่า AI ไม่ได้ทำการตัดสินใจที่แท้จริง

จนกว่าการพัฒนา AI จะแสดงให้เห็นถึงความสามารถในการตัดสินใจโดยไม่เพียงแต่เลือกผลลัพธ์ที่รู้จักจากข้อมูลการฝึกเท่านั้น แต่ยังต้องแสดงให้เห็นถึงความสามารถในการพิจารณาข้อมูลและตัดสินใจอย่างมีเหตุผล จึงสามารถกล่าวได้ว่า AI ยังไม่พร้อมที่จะทำการตัดสินใจเกี่ยวกับประเด็นทางศีลธรรมหรือผู้สมัครงาน

นักเขียนเกี่ยวกับเครื่องมือการเรียนรู้ของเครื่อง และผู้เชี่ยวชาญด้านการสังเคราะห์ภาพมนุษย์ อดีตหัวหน้าเนื้อหาวิจัยที่ Metaphysic.ai จนกระทั่งถูกยุบเข้ากับ Brahma.ai ของ DNEG
Portfolio site: martinanderson.ai
Contact: martin@martinanderson.ai