ความร่วมมือ
OpenAI ตั้งใจจะใช้ Cerebras มูลค่า 10 พันล้านดอลลาร์สำหรับการคำนวณความหน่วงต่ำ

OpenAI ประกาศข้อตกลงหลายปีกับ Cerebras Systems (CBRS ) ซึ่งเป็นสตาร์ทอัพชิปที่จะส่งมอบ 750 เมกะวัตต์ของการคำนวณ AI ที่อุทิศให้กับ ChatGPT โดยทั้งสองบริษัทอธิบายว่าเป็น การนำไปใช้การอนุมานความเร็วสูงขนาดใหญ่ที่สุด ที่เคยพยายาม。
ข้อตกลงนี้มีมูลค่ามากกว่า 10 พันล้านดอลลาร์ตามแหล่งข้อมูลที่คุ้นเคยกับเงื่อนไข ซึ่งเป็นการเดิมพันโครงสร้างพื้นฐานที่สำคัญที่สุดของ OpenAI นอกเหนือจากความสัมพันธ์หลักกับ Microsoft (MSFT ) Cerebras จะสร้างและจัดโฮสต์ระบบเหล่านี้เป็นระยะจนถึงปี 2028 โดยจะมีความจุแรกออนไลน์ในปีนี้
การร่วมมือมุ่งเป้าไปที่ปัญหาเฉพาะ: ความเร็ว ในขณะที่ OpenAI ได้ขยาย ChatGPT ไปถึง 800 ล้านผู้ใช้รายสัปดาห์ บริษัทต้องเผชิญกับการจำกัดความสามารถในการคำนวณที่ชะลอเวลาในการตอบสนอง—โดยเฉพาะสำหรับงานที่ต้องการมาก เช่น การสร้างโค้ด การทำงานของตัวแทน และการโต้ตอบเสียงแบบเรียลไทม์
“Cerebras เพิ่มโซลูชันการอนุมานความหน่วงต่ำที่อุทิศให้กับแพลตฟอร์มของเรา” Sachin Katti ซึ่งเป็นผู้นำกลยุทธ์การคำนวณของ OpenAI กล่าว “หมายถึงการตอบสนองเร็วขึ้น การโต้ตอบที่เป็นธรรมชาติมากขึ้น และรากฐานที่แข็งแกร่งกว่าในการขยาย AI แบบเรียลไทม์ให้กับคนมากขึ้น”
ทำไมซิลิกอนขนาดเวฟเฟอร์จึงสำคัญ
การเสนอขายของ Cerebras มีศูนย์กลางอยู่ที่โปรเซสเซอร์ขนาดเวฟเฟอร์—ชิปขนาดจานอาหารที่กำจัดความล่าช้าในการสื่อสารที่มีอยู่ในระบบที่เย็บด้วย GPU หลายตัว บริษัทอ้างว่าสถาปัตยกรรมของตนให้ความเร็วการอนุมานสูงถึง 15 เท่าเมื่อเทียบกับทางเลือกที่ใช้ GPU โดยมีโมเดล เช่น GPT-OSS-120B ที่ทำงานที่ประมาณ 3,000 โทเค็นต่อวินาที
สำหรับ OpenAI ความเร็วที่แปลเป็นประสบการณ์ของผู้ใช้ เมื่อ AI ตอบสนองในเวลาเรียลไทม์—โดยไม่มีความล่าช้าที่ทำให้การโต้ตอบดูไม่จริงจัง—ผู้ใช้จะเข้าไปมีส่วนร่วมมากขึ้นและบรรลุเป้าหมายมากขึ้น บริษัทได้ทดสอบซิลิกอนของ Cerebras กับโมเดลที่เปิดเผยถึงน้ำหนักของพวกเขา trướcวันขอบคุณพระเจ้า และการอภิปรายทางเทคนิคระหว่างทีมงานได้เร่งไปสู่การเซ็นสัญญา ตามที่ Andrew Feldman ซีอีโอของ Cerebras กล่าว
“เช่นเดียวกับการที่อินเทอร์เน็ตบรอดแบนด์เปลี่ยนแปลงอินเทอร์เน็ต การอนุมานแบบเรียลไทม์จะเปลี่ยนแปลง AI” เฟลด์แมนกล่าว “สิ่งนี้ช่วยให้สามารถสร้างและโต้ตอบกับโมเดล AI ได้ใหม่”
การเปรียบเทียบไม่ใช่การขยายความเกินจริง อินเทอร์เน็ตแบบไดอัลอัพในยุคแรกรองรับอีเมลและบราวเซอร์แบบพื้นฐาน ในขณะที่บรอดแบนด์ทำให้สามารถสตรีมวิดีโอ โทรศัพท์ และในที่สุดก็เศรษฐกิจของแอปสมาร์ทโฟน OpenAI ดูเหมือนจะเดิมพันว่าความเร็วการอนุมานที่เพียงพอจะปลดล็อกแอปพลิเคชันที่ความหน่วงปัจจุบันทำให้ไม่เหมาะสม—โดยเฉพาะสำหรับตัวแทน AI ที่ต้องเชื่อมโยงการดำเนินการที่ซับซ้อนหลายอย่างโดยไม่ทำให้ผู้ใช้หมดความอดทน
การแข่งขันโครงสร้างพื้นฐานรุนแรงขึ้น
ข้อตกลง Cerebras เกิดขึ้นเมื่อ การประเมินโครงสร้างพื้นฐาน AI เพิ่มขึ้นอย่างมาก โดย Databricks เพิ่งระดมทุนมูลค่า 134 พันล้านดอลลาร์ และ Cerebras เองก็รายงานว่าอยู่ในการเจรจาเพื่อระดมทุนใหม่ในมูลค่า 22 พันล้านดอลลาร์ ความต้องการการคำนวณของโมเดล AI แนวหน้าไม่แสดงสัญญาณของการชะลอตัว และบริษัทต่างๆ กำลังพยายามจองความจุก่อนที่คู่แข่งจะทำ
สำหรับ Cerebras การร่วมมือกับ OpenAI จะแก้ปัญหาในการกระจายความเสี่ยงทางธุรกิจ สหรัฐอาหรับเอมิเรตส์ G42 มีส่วนสนับสนุน 87% ของรายได้ของ Cerebras ในครึ่งแรกของปี 2024—ลูกค้าหลักที่ทำให้นักลงทุนตื่นตระหนก การเพิ่ม OpenAI เป็นลูกค้าหลัก่อนการเสนอขายหุ้นแก่ประชาชนทั่วไป (IPO) ที่อาจเกิดขึ้นจะลดความเสี่ยงทางธุรกิจอย่างมาก
สำหรับ OpenAI ข้อตกลงนี้จะกระจาย โครงสร้างพื้นฐาน AI ของตนเองไปไกลกว่าคลาวด์ Azure ของ Microsoft ในขณะที่ Microsoft ยังคงเป็นผู้ให้บริการการคำนวณหลักของ OpenAI การร่วมมือกับ Cerebras จะให้ความจุความหน่วงต่ำที่อุทิศให้กับการอนุมานโดยเฉพาะ—งานที่แตกต่างจากการฝึกอบรมที่โครงสร้างพื้นฐานของ Microsoft จัดการ
เวลาก็มีความสำคัญเช่นกัน OpenAI เพิ่งเผยโฉม GPT-5.2 ในช่วงที่มีการแข่งขันที่รุนแรงจาก Gemini ของ Google (GOOGL ) เมื่อโมเดลมีความสามารถมากขึ้น บริษัทที่ใช้งานโมเดลเหล่านั้นกำลังพบว่าความฉลาดดิบเพียงอย่างเดียวไม่เพียงพอ—ผู้ใช้ก็คาดหวังการตอบสนองที่เกิดขึ้นในเวลาใกล้เคียงที่สุด AI ที่ยอดเยี่ยมที่ต้องใช้เวลา 10 วินาทีในการตอบจะดูเหมือนเสียหาย; AI เหมือนเดิมที่ตอบสนองในเวลาไม่ถึง 1 วินาทีจะดูเหมือน
Sam Altman ซีอีโอของ OpenAI เป็นนักลงทุนใน Cerebras แล้ว และ OpenAI เคยพิจารณาเข้าซื้อกิจการ Cerebras อย่างเต็มรูปแบบ ข้อตกลงนี้ชี้ให้เห็นว่าความสัมพันธ์กำลังพัฒนาเป็นบางสิ่งที่มีกลยุทธ์มากขึ้น: การร่วมมือที่ทั้งสองบริษัทจะเชื่อมโยงโชคชะตาของตนเองในการแข่งขันเพื่อทำให้ AI ดูเหมือนจริงในการสนทนา












