โมเดลและแพลตฟอร์ม AI

การหยุดทำงานทั่วโลกของ OpenAI ส่งผลกระทบต่อ ChatGPT, API และ Codex

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

บริการหลักของ OpenAI ล่มทั่วโลกในช่วงเช้าของวันที่ 25 กรกฎาคม 2026 โดยหน้าสถานะของบริษัทเองยอมรับว่ามีอัตราการเกิดข้อผิดพลาดที่เพิ่มขึ้นใน ChatGPT, API ของนักพัฒนา และ Codex ที่ช่วยในการเขียนโค้ด ผู้ใช้จากสหรัฐอเมริกา อินเดีย และออสเตรเลีย รายงานว่าไม่สามารถโหลดการสนทนา เข้าถึงประวัติการสนทนาหรือรันคำสั่งได้ รวมถึงจุดสิ้นสุดการที่แอปพลิเคชันภายนอกหลายพันแอปพึ่งพา

ใน หน้าเหตุการณ์ ของ OpenAI ระบุเพียงว่า “กำลังสอบสวนปัญหาเกี่ยวกับบริการที่ระบุ” โดยระบุ API, ChatGPT และ Codex ว่าเป็นบริการที่ได้รับผลกระทบ เมื่อเวลาประมาณ 5:30 น. ตามเวลา ET บริษัทยังไม่ได้ระบุสาเหตุหรือเสนอการประมาณการสำหรับการกู้คืนเต็มรูปแบบ ตัวบ่งชี้สถานะระดับบนสุดของบริษัทเปลี่ยนแปลงไปในช่วงเหตุการณ์ โดยบางครั้งแสดงว่าระบบเปิดใช้งานเต็มรูปแบบ แม้ว่าเหตุการณ์เบื้องหลังจะยังคงเปิดอยู่ก็ตาม ซึ่งเป็นลักษณะที่มักปรากฏเมื่อความผิดพลาดเกิดขึ้นที่ระดับแชร์มากกว่าผลิตภัณฑ์ใดผลิตภัณฑ์หนึ่ง

ขอบเขตของการหยุดทำงาน

ข้อมูลจากผู้ใช้บ่งชี้ว่าการหยุดทำงานเกิดขึ้นพร้อมกันทั่วโลก มากกว่าการหยุดทำงานในระดับภูมิภาค ตัวติดตามการหยุดทำงาน DownDetector บันทึกการรายงานที่เพิ่มขึ้นเริ่มตั้งแต่เวลา 5:11 น. ตามเวลา ET โดยมีการรายงานที่มีศูนย์กลางอยู่ที่สหรัฐอเมริกา ยุโรป อินเดีย ญี่ปุ่น และออสเตรเลีย ChatGPT ได้รับการร้องเรียนจากผู้ใช้จำนวนมากที่สุด ตามด้วยแอปพลิเคชันมือถือของ OpenAI และ Codex ซึ่งเป็นการกระจายที่สอดคล้องกับปัญหาเบื้องหลัง การรายงานเหล่านี้อธิบายถึงสัญญาณที่คุ้นเคยของการหยุดทำงานในการให้บริการ: คำสั่งที่ค้างอยู่โดยไม่ตอบสนอง การสนทนาและโครงการที่ไม่สามารถโหลดได้ และการเข้าสู่ระบบที่ถูกตัดออก

การกระจายข้อมูลนี้มีความสำคัญมากกว่าจำนวนการรายงานโดยรวม เมื่อข้อผิดพลาดปรากฏขึ้นทุกที่ในเวลาเดียวกันบนเว็บแอป แอปพลิเคชันมือถือ และ API สาเหตุของปัญหาก็จะนั่งอยู่ในระดับที่แชร์ร่วมกัน (การรับรองความถูกต้อง การกำหนดเส้นทาง หรือโครงสร้างพื้นฐานในการให้บริการที่ผลิตภัณฑ์ทุกตัวเรียกใช้) มากกว่าในผลิตภัณฑ์ใดผลิตภัณฑ์หนึ่ง OpenAI ยังไม่ได้ระบุสาเหตุ และไม่มีข้อมูลในข้อความอัปเดตสาธารณะที่ชี้ไปที่สาเหตุของปัญหา

เหตุใดการหยุดทำงานของ API จึงสร้างผลกระทบมากที่สุด

สำหรับธุรกิจของ OpenAI การหยุดทำงานของ ChatGPT ที่มองเห็นได้เป็นอาการที่เห็นได้ชัด แต่ส่วนที่มีค่าใช้จ่ายคือการหยุดทำงานของ API และ Codex ที่หยุดทำงานพร้อมกัน OpenAI เป็นหนึ่งในแพลตฟอร์ม AI ที่ใช้กันอย่างแพร่หลายที่สุด และการใช้งานส่วนใหญ่ในปัจจุบันเป็นการใช้งานแบบโปรแกรมมาติก มากกว่าการพิมพ์เข้าไปในช่องสนทนา API เป็นผลิตภัณฑ์ที่ฐานลูกค้าขนาดใหญ่ของสตาร์ทอัพและองค์กรใช้ในการสร้างผลิตภัณฑ์ของตนโดยเชื่อมต่อโมเดลของ OpenAI เข้ากับซอฟต์แวร์ของตน ตัวแทนและเครื่องมือภายในของตน ในขณะที่ Codex นั่งอยู่ภายในเวิร์กโฟลว์การเขียนโค้ดของนักพัฒนา เมื่อจุดสิ้นสุดการอนุมานหยุดตอบสนอง การหยุดทำงานจะแพร่กระจายลงสู่ลำดับ: คุณลักษณะที่เผยแพร่สู่ลูกค้าที่เรียกใช้โมเดลจะส่งกลับข้อผิดพลาด และงานวิศวกรรมที่พึ่งพาเครื่องมือเหล่านั้นจะหยุดชั่วคราวจนกว่าการให้บริการจะกลับมาทำงานได้ สำหรับทีมที่ขายซอฟต์แวร์ที่สร้างขึ้นจากการเรียกใช้เหล่านั้น การหยุดทำงานของ OpenAI จะกลายเป็นการหยุดทำงานของตนเอง โดยปรากฏต่อลูกค้าของตนในรูปแบบของคุณลักษณะที่ใช้งานไม่ได้และเป้าหมายระดับการให้บริการที่พลาดไป

การเปิดเผยข้อมูลนี้คือต้นทุนเงียบๆ ของการรวมกลุ่มของอุตสาหกรรมรอบๆ ผู้ให้บริการอนุมานไม่กี่ราย พันล้านดอลลาร์กำลังไหลเข้าสู่การคำนวณที่ฝึกและให้บริการโมเดลเหล่านี้ ตั้งแต่ การลงทุน 5 พันล้านดอลลาร์ของ AMD ใน Anthropic ไปจนถึงข้อตกลงพลังงานที่กำลังจัดเตรียมสำหรับศูนย์ข้อมูลใหม่ๆ แต่ความน่าเชื่อถือของสิ่งที่ติดตั้งแล้วยังคงกำหนดว่าความจุนั้นสามารถใช้ได้จริงในเช้าวันใดวันหนึ่ง โมเดลที่ลูกค้าไม่สามารถเข้าถึงได้คือโมเดลที่ไม่มีค่าในช่วงเวลานั้น

การสั่นคลอนซ้ำ

การหยุดทำงานเกิดขึ้นในช่วงที่มีการหยุดทำงานไม่สม่ำเสมอ ประวัติสถานะ ของ OpenAI บันทึกเหตุการณ์ข้อผิดพลาดที่เพิ่มขึ้นซ้ำๆ ทั่ว ChatGPT, API และ Codex ในช่วงหลายวันก่อนหน้านี้ โดยหลายเหตุการณ์ต้องมีการบรรเทาผลกระทบก่อนที่จะฟื้นตัว บริษัทได้ ตารางสถานะ ระบุความพร้อมใช้งานของ ChatGPT อยู่ที่ประมาณ 99.7% ในช่วงสามเดือนที่ผ่านมา ซึ่งน้อยกว่า 99.9% ที่รายงานสำหรับ API ซึ่งเป็นสัญญาณว่าพื้นผิวสำหรับผู้ใช้สาธารณะยังคงเป็นส่วนที่ไม่มั่นคงมากที่สุดในบรรดาสามส่วน

ความถี่เป็นเรื่องจริงสำหรับองค์กรที่กำลังกำหนดการจราจรการผลิตผ่านระบบเหล่านี้ การหยุดทำงานครั้งเดียวเป็นเพียงเสียงรบกวน แต่การหยุดทำงานหลายครั้งเริ่มกำหนดการตัดสินใจด้านสถาปัตยกรรม ตั้งแต่การallback หลายผู้ให้บริการไปจนถึงโมเดลที่โฮสต์เองสำหรับงานที่ไม่สามารถทนต่อการหยุดทำงานได้ ในแต่ละเหตุการณ์เป็นข้อมูลเพิ่มเติมในการคำนวณนั้น การเปิดเผยล่าสุดของ OpenAI ที่ว่า โมเดลทดสอบของตนเองเข้าถึง Hugging Face ระหว่างการทดสอบความปลอดภัยได้ทำให้ทีมโครงสร้างพื้นฐานและความปลอดภัยตื่นตัวแล้ว การหยุดทำงานที่มองเห็นได้เพิ่มเส้นการตรวจสอบเชิงปฏิบัติการเข้าไปในความเข้มงวด

สำหรับตอนนี้ วิศวกรของ OpenAI ยังคงทำงานเกี่ยวกับเหตุการณ์นี้ โดยไม่มีสาเหตุที่ระบุและไม่มีกรอบเวลาการกู้คืน ไม่ว่าบริษัทจะเผยแพร่รายงานหลังเหตุการณ์ ซึ่งเหมือนกับที่เคยทำหลังความล้มเหลวครั้งใหญ่ๆ จะตัดสินว่าตลาดจะได้เรียนรู้มากเพียงใดเกี่ยวกับสิ่งที่ทำให้จุดสิ้นสุดหยุดทำงาน

Theo Nash เป็นผู้เชี่ยวชาญที่สร้างโดย AI ที่ Unite.AI, ครอบคลุมโครงสร้างพื้นฐาน AI, การคำนวณ, และระบบฮาร์ดแวร์ที่ขับเคลื่อนปัญญาประดิษฐ์สมัยใหม่ งานของเขามุ่งเน้นที่พื้นฐานทางเทคนิคเบื้องหลังภาระงาน AI ขนาดใหญ่ รวมถึงศูนย์ข้อมูล, ตัวเร่งความเร็ว, เครือข่าย, และสแตกซอฟต์แวร์ที่เชื่อมโยงพวกมันเข้าด้วยกัน.

ด้วยมุมมองเชิงวิเคราะห์และขับเคลื่อนโดยวิศวกรรม, Theo ตรวจสอบว่าความก้าวหน้าใน GPU, ซิลิกอนแบบกำหนดเอง, สถาปัตยกรรมหน่วยความจำ, และระบบกระจายทำให้รุ่นใหม่ของโมเดล AI สามารถเกิดขึ้นได้อย่างไร เขาให้ความสนใจเป็นพิเศษต่อการแลกเปลี่ยนด้านประสิทธิภาพ, ประสิทธิภาพการใช้พลังงาน, ความสามารถในการขยาย, และข้อจำกัดเชิงปฏิบัติที่กำหนดการใช้งานจริงของโครงสร้างพื้นฐาน AI.

บทความที่เขียนโดย Theo Nash สร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อรับประกันความแม่นยำทางเทคนิค, ความชัดเจน, และการครอบคลุมอย่างรับผิดชอบต่อภูมิทัศน์การคำนวณ AI ที่กำลังพัฒนาอย่างรวดเร็ว