โมเดลและแพลตฟอร์ม AI

OpenAI กล่าวว่าเอเจนท์ครอบคลุม 3.1 วันทำงานต่อวันทำงานของนักวิจัย

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

องค์กรวิจัยของ OpenAI ตอนนี้ทำงานเทียบเท่ากับ 3.1 วันทำงานของเอเจนท์ต่อแต่ละวันทำงานของมนุษย์ บริษัทได้กล่าวไว้ใน บทความเมื่อ 8 กันยายน 2026 ซึ่งอธิบายวิธีที่บริษัทตั้งใจแปลงความสามารถของโมเดลระดับแนวหน้าให้เป็นรายได้ ตัวเลขนี้วัดจากวันทำงานมาตรฐาน 8 ชั่วโมง ณ กลางเดือนสิงหาคม 2026 และเป็นฐานของข้อโต้แย้งที่กว้างขึ้นของหัวหน้าฝ่ายการเงิน Sarah Friar ว่าโมเดลที่มีความสามารถมากขึ้น ฐานผู้ใช้ที่มีผู้ใช้งานประจำสัปดาห์มากกว่าหนึ่งพันล้านคน และกลยุทธ์คอมพิวเตอร์แบบเต็มสแตกเสริมกันและกัน

บทความนี้มีชื่อว่า “The Work Now Within Reach” และเป็นบทความล่าสุดของ Friar ในชุดเรื่องราวเกี่ยวกับธุรกิจและเศรษฐศาสตร์การคอมพิวเตอร์ของ OpenAI OpenAI แต่งตั้ง Friar เป็น CFO ในเดือนมิถุนายน 2024 ก่อนหน้านั้นเธอเคยดำรงตำแหน่ง CEO ของ Nextdoor และ CFO ของ Square

การใช้งานและรายได้

OpenAI กล่าวว่า ผลิตภัณฑ์ของบริษัทเข้าถึงผู้ใช้ประจำสัปดาห์มากกว่าหนึ่งพันล้านคนและธุรกิจ 2.5 ล้านแห่ง และการพัฒนาการวิจัยแต่ละครั้งช่วยปรับปรุง ChatGPT, ChatGPT Work, Codex และแอปพลิเคชันที่สร้างบน API ของบริษัท บริษัทระบุว่าการเข้าถึงฟรีที่สนับสนุนโดยโฆษณาช่วยให้ผู้คนค้นพบว่าปัญญาประดิษฐ์มีประโยชน์ที่ไหน ในขณะที่การสมัครสมาชิกและข้อเสนอแบบใช้ตามการใช้งานทำให้ลูกค้าใช้จ่ายเพิ่มขึ้นเมื่อพวกเขาพบคุณค่ามากขึ้น

อ้างอิงจากการศึกษาการใช้แผน ChatGPT รายบุคคล OpenAI รายงานว่าปริมาณข้อความต่อวันเพิ่มขึ้นประมาณ 50% หลังจากสมัครใช้บริการหกเดือนเทียบกับเดือนแรก และผู้ใช้ได้ลองทำงานที่แตกต่างกันประมาณสองเท่า การวิเคราะห์นี้อ้างอิงจากตัวอย่าง 0.1% ของบัญชีที่สร้างระหว่าง 15 ตุลาคม 2025 ถึง 1 พฤษภาคม 2026 โดยติดตามกิจกรรมจนถึง 31 พฤษภาคม 2026; วัดจำนวนข้อความและความหลากหลายของงานโดยอิงจาก 28 วันแรกของผู้ใช้แต่ละคนและจัดประเภทข้อความเป็น 53 หมวดความสามารถ

บทความยังชี้ให้เห็นถึงการใช้งานของลูกค้า 5 ราย โรงพยาบาลเด็กบอสตัน (Boston Children’s Hospital) รายงานว่ามีการวินิจฉัยมากกว่า 40 รายการในกรณีโรคหายากที่ไม่สามารถแก้ไขได้ก่อนหน้านี้ผ่านการวิจัยที่ช่วยโดย AI Cars24 กล่าวว่าเอเจนท์ของพวกเขาจัดการการสนทนามากกว่าหนึ่งล้านนาทีต่อเดือนในกระบวนการซื้อและขายรถยนต์ Circles รายงานว่าการแก้ไขปัญหาบริการลูกค้าแบบอัตโนมัติได้ 65% ของการโต้ตอบในกระบวนการทำงานที่สนับสนุน และ Balyasny Asset Management กล่าวว่า Central Bank Speech Analyst ของพวกเขาลดระยะเวลาการวิเคราะห์สถานการณ์เศรษฐกิจมหภาคจากสองวันเหลือประมาณ 30 นาที Replit มีโหมดฟรี (Free Mode) ที่ให้ผู้ใช้วางแผนซอฟต์แวร์โดยไม่ใช้โควต้าการใช้งาน ตัวเลขทั้งหมดมาจากบัญชีของลูกค้าเองตามที่ OpenAI นำเสนอ

เอเจนท์ภายในองค์กรวิจัย

ตัวเลข 3.1 วันทำงานของเอเจนท์มาจากอัปเดตการวิจัยของ OpenAI ที่เผยแพร่เมื่อ 6 กันยายน 2026 ซึ่งระบุว่าก่อนเดือนมิถุนายน 2026 ระยะเวลาการทำงานของเอเจนท์ทั้งหมดในองค์กรวิจัยยังต่ำกว่าการทำงานของมนุษย์โดยรวม การอัปเดตนั้นระบุว่านักวิจัยระดับกลางใช้ค่า inference มากกว่า $600 ต่อวันตามราคาที่ API กำหนด ณ กลางเดือนสิงหาคม และผู้ใช้ในเปอร์เซ็นไทล์ที่ 90 ใช้โทเคนมากกว่า $7,000 ต่อวัน

อัปเดตเดียวกันระบุว่าอัตราความสำเร็จของเอเจนท์โค้ดดิ้งเพิ่มขึ้นตั้งแต่เดือนมกราคมถึงกรกฎาคม 2026 ในหลายระดับความยากของงาน โดยยังคงชี้ให้เห็นว่างานที่ยาวนานยังต้องการการควบคุมจากมนุษย์: ในช่วงหกเดือนที่ผ่านมา มากกว่าครึ่งหนึ่งของงานที่สำเร็จและประเมินว่าต้องใช้เวลามนุษย์ 4‑8 ชั่วโมง มีการแทรกแซงอย่างน้อยหนึ่งครั้ง ในบทความ OpenAI กล่าวว่า ผู้คนยังคงกำหนดลำดับความสำคัญของการวิจัยและประเมินผลลัพธ์ และทีมงานกำลังใช้เอเจนท์เพื่อแก้ไขปัญหาโครงสร้างพื้นฐานที่เคยต้องอาศัยผู้เชี่ยวชาญ

ความสามารถของโมเดลและต้นทุนการประมวลผล

บทความของ Friar นำเสนอ GPT-6 Astra ว่าเป็นตัวขับเคลื่อนความสามารถในปัจจุบัน โดยอธิบายว่าเป็นระดับแนวหน้าด้านการใช้คอมพิวเตอร์ การท่องเว็บ วิศวกรรมซอฟต์แวร์ ความปลอดภัยไซเบอร์ วิทยาศาสตร์ และงานระดับมืออาชีพ ในโพสต์เปิดตัว OpenAI รายงานว่า Astra ได้คะแนน 98% ใน FrontierMath Tier 4, 99.9% ใน ARC‑AGI‑3, และ 100% ใน ExploitBench รวมทั้งผ่านเกณฑ์ Critical ในด้านความปลอดภัยไซเบอร์ตามกรอบ Preparedness Framework ของบริษัท ผลลัพธ์เหล่านี้เป็นข้อมูลที่ OpenAI รายงานเอง บริษัทบอกว่า Astra เริ่มเปิดให้กับองค์กรจำนวนจำกัดเมื่อ 3 กันยายน 2026 และจะมีให้ใช้ทั่วไปในระดับชำระเงินของ ChatGPT, API, Microsoft Azure และ AWS Bedrock ในวันต่อ ๆ ไป

เกี่ยวกับเศรษฐศาสตร์การให้บริการ บทความย้ำสองตัวเลขจากโพสต์วิศวกรรมของ OpenAI เมื่อ 29 กรกฎาคม 2026 เกี่ยวกับ GPT‑5.6: การปรับปรุงซอฟต์แวร์การให้บริการที่ลดต้นทุนการให้บริการแบบต้นถึงปลายลง 20% และงานการถอดรหัสเชิงสเปคิวเลทีฟที่เพิ่มประสิทธิภาพการสร้างโทเคนมากกว่า 15% ทั้งสองผลลัพธ์บรรลุด้วย GPT‑5.6 Sol ที่ทำงานภายใน Codex รวมถึงการเขียนโคเดอร์การผลิตใหม่โดยอัตโนมัติตามที่โพสต์วิศวกรรมระบุ

บทความยังสรุปผลลัพธ์แรกของ Jalapeño ชิป inference แบบกำหนดเองของ OpenAI ที่เผยแพร่ครั้งแรกเมื่อ 25 สิงหาคม 2026 ในการทดสอบ InferenceX กับ GPT‑OSS 120B, DeepSeek R1, และ Kimi K2.5 OpenAI รายงานว่าชิปนี้ให้อัตราการส่งผ่านโทเคนสูงสุดต่อวัตต์ได้ 1.5‑1.9 เท่าของระบบเชิงพาณิชย์ที่ทดสอบโดยใช้กำลังไฟฟ้าของชิปที่ระบุเพื่อทำการเปรียบเทียบ พร้อมด้วยความหน่วงเวลาแบบต้นถึงปลายที่ต่ำกว่าระบบเชิงพาณิชย์ 1.7‑3.6 เท่า OpenAI กล่าวว่าจะเริ่มนำ Jalapeño ไปใช้ในโครงสร้างพื้นฐานคอมพิวเตอร์ของตนภายในสิ้นปีพร้อมกับอุปกรณ์เร่งความเร็วจาก NVIDIA, AMD และพันธมิตรอื่น ๆ และรุ่นที่สองและสามกำลังอยู่ในขั้นพัฒนา

Friar เขียนว่า OpenAI ประเมินการลงทุนแต่ละครั้งโดยพิจารณาจากความต้องการที่สามารถตอบสนองได้ ความเร็วที่ทำให้เป็นประโยชน์ และว่าผลตอบแทนคุ้มค่ากับเงินทุนที่ลงไปหรือไม่ และรายได้จากการยอมรับที่เพิ่มขึ้นจะนำไปสนับสนุนการวิจัยและโครงสร้างพื้นฐานต่อไป

จอนาส รีฟ เป็นนักวิเคราะห์ที่สร้างโดย AI ที่ Unite.AI โดยมุ่งเน้นไปที่ปัญญาประดิษฐ์แบบ认知 (Cognitive AI) ปัญญาประดิษฐ์ทั่วไป (Artificial General Intelligence - AGI) และรากฐานทางทฤษฎีของปัญญาประดิษฐ์ เขาได้สำรวจว่ากระบวนการเรียนรู้ การให้เหตุผล ความจำ และการสรุปผลเกิดขึ้นในระบบทางชีววิทยาและระบบประดิษฐ์ โดยเชื่อมโยงระหว่างโครงสร้าง AI สมัยใหม่และคำถามที่มีมานานในด้านวิทยาศาสตร์认知และปรัชญาของจิต

ด้วยแนวทางเชิงแนวคิดและสะท้อนกลับ จอนาสได้ตรวจสอบกรอบการทำงาน เช่น โมเดลการให้เหตุผล ระบบอージェนต์ การรับรู้ที่เกิดขึ้น และทฤษฎีการจัดตำแหน่ง โดยมีเป้าหมายเพื่อชี้แจงว่าการก้าวหน้าไปสู่ AGI หมายถึงอะไร และไม่หมายถึงอะไร โดยไม่ได้ตาม đuổiเส้นเวลาหรือการโฆษณา เขาเน้นย้ำถึงหลักการแรก การใช้เหตุผลเชิงแนวคิด และข้อจำกัดของโมเดลปัจจุบัน

บทความที่เขียนโดยจอนาส รีฟเป็นผลงานที่สร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อให้แน่ใจถึงความถูกต้อง ความชัดเจน และการอภิปรายที่มีความรับผิดชอบเกี่ยวกับแนวคิด AI ที่ทันสมัย