AGI และ AI แห่งอนาคต
Inflection-2.5: โมเดล LLM ที่มีพลังแข่งกับ GPT-4 และ Gemini
Inflection AI ได้สร้างความตื่นตะลึงในด้านโมเดลภาษาขนาดใหญ่ (LLM) ด้วยการเปิดตัว Inflection-2.5 โมเดลที่แข่งขันกับ LLM ชั้นนำของโลก รวมถึง GPT-4 ของ OpenAI และ Gemini ของ Google
การเติบโตอย่างรวดเร็วของ Inflection AI ได้รับการสนับสนุนจากเงินลงทุนจำนวนมากถึง 1.3 พันล้านดอลลาร์ ซึ่งนำโดยผู้นำในอุตสาหกรรม เช่น Microsoft (MSFT ), NVIDIA (NVDA ) และนักลงทุนที่มีชื่อเสียง เช่น Reid Hoffman, Bill Gates และ Eric Schmidt เงินลงทุนนี้ทำให้ยอดเงินลงทุนทั้งหมดที่บริษัทได้รับเป็น 1.525 พันล้านดอลลาร์
ในความร่วมมือกับ CoreWeave (CRWV ) และ NVIDIA Inflection AI กำลังสร้างคลัสเตอร์ AI ที่ใหญ่ที่สุดในโลก โดยประกอบด้วย GPU H100 Tensor Core ของ NVIDIA ถึง 22,000 หน่วย คลัสเตอร์นี้จะรองรับการฝึกอบรมและใช้งานโมเดล AI ระดับใหญ่ ทำให้ Inflection AI สามารถขยายขอบเขตของความเป็นไปได้ในด้าน AI ส่วนบุคคล
ผลงานที่น่าประทับใจของ Inflection AI ได้แสดงให้เห็นแล้ว โดยคลัสเตอร์ Inflection AI ซึ่งประกอบด้วย GPU H100 Tensor Core ของ NVIDIA มากกว่า 3,500 หน่วย ได้แสดงผลการทำงานที่เป็นเลิศบนแบンチมาร์ก MLPerf ในการยื่นคำขอแบบสหบริษัทกับ CoreWeave และ NVIDIA คลัสเตอร์ได้เสร็จสิ้นงานฝึกอบรมอ้างอิงสำหรับโมเดลภาษาขนาดใหญ่ในเวลาเพียง 11 นาที ทำให้ได้รับการยืนยันว่าเป็นคลัสเตอร์ที่เร็วที่สุดในแบンチมาร์กนี้
ความสำเร็จนี้ตามมาจากการเปิดตัว Inflection-1 โมเดลภาษาขนาดใหญ่ในบ้านของ Inflection AI ซึ่งได้รับการยกย่องว่าเป็นโมเดลที่ดีที่สุดในชั้นเรียนการคำนวณของมัน โดยสามารถเอาชนะโมเดลชั้นนำในอุตสาหกรรม เช่น GPT-3.5, LLaMA, Chinchilla และ PaLM-540B ในหลายแบンチมาร์กที่ใช้สำหรับการเปรียบเทียบ LLM Inflection-1 ทำให้ผู้ใช้สามารถสื่อสารกับ Pi โมเดล AI ส่วนบุคคลของ Inflection AI ในรูปแบบที่เรียบง่ายและเป็นธรรมชาติ โดยได้รับข้อมูลและคำแนะนำที่รวดเร็ว ทันสมัย และมีประโยชน์
ความมุ่งมั่นของ Inflection AI ในด้านความโปร่งใสและความสามารถในการทำซ้ำได้เห็นได้ชัดเจนในการเผยแพร่บันทึกทางเทคนิคเกี่ยวกับการประเมินและผลการทำงานของ Inflection-1 บนหลายแบンチมาร์ก บันทึกนี้เผยให้เห็นว่า Inflection-1 มีผลการทำงานที่เหนือกว่าโมเดลในชั้นเรียนการคำนวณเดียวกัน ซึ่งถูกกำหนดเป็นโมเดลที่ฝึกอบรมโดยใช้ FLOPs (การดำเนินการแบบ 浮動小数点) ไม่เกินของ PaLM-540B
ความสำเร็จของ Inflection-1 และการขยายตัวของโครงสร้างพื้นฐานการคำนวณของบริษัทซึ่งได้รับการสนับสนุนจากเงินลงทุนจำนวนมาก ทำให้ Inflection AI มุ่งมั่นในการส่งมอบภารกิจในการสร้าง AI ส่วนบุคคลสำหรับทุกคน ด้วยการรวม Inflection-1 เข้ากับ Pi ผู้ใช้สามารถสัมผัสกับพลังของ AI ส่วนบุคคล โดยได้รับประโยชน์จากบุคลิกที่เห็นอกเห็นใจ ความมีประโยชน์ และมาตรฐานความปลอดภัย
Inflection-2.5
Inflection-2.5 เปิดให้บริการสำหรับผู้ใช้ทั้งหมดของ Pi โมเดล AI ส่วนบุคคลของ Inflection AI บนหลายแพลตฟอร์ม รวมถึงเว็บ (pi.ai) iOS Android และแอปเดสก์ท็อปใหม่ การรวมนี้เป็นก้าวสำคัญในภารกิจของ Inflection AI ในการสร้าง AI ส่วนบุคคลสำหรับทุกคน โดยรวมพลังการทำงานด้วยบุคลิกที่เห็นอกเห็นใจและมาตรฐานความปลอดภัย
การกระโดดในด้านประสิทธิภาพ Inflection AI โมเดลก่อนหน้านี้ Inflection-1 ใช้ประมาณ 4% ของ FLOPs (การดำเนินการแบบ 浮動小数点) ของ GPT-4 และแสดงผลการทำงานเฉลี่ยประมาณ 72% เมื่อเทียบกับ GPT-4 ในหลายงานที่เน้นความฉลาด ด้วย Inflection-2.5 Inflection AI ได้เพิ่มความสามารถด้านปัญญาของ Pi โดยมุ่งเน้นในด้านการเขียนโค้ดและคณิตศาสตร์
ผลการทำงานของโมเดลบนแบ่งชมาร์กอุตสาหกรรมหลักแสดงให้เห็นถึงความสามารถ โดยแสดงผลการทำงานมากกว่า 94% ของ GPT-4 ในหลายงาน โดยเฉพาะในด้าน STEM และการเขียนโค้ด ความสำเร็จที่น่าประทับใจนี้เป็นหลักฐานของความมุ่งมั่นของ Inflection AI ในการขยายขอบเขตของความเป็นไปได้ในด้าน AI โดยยังคงเน้นไปที่ประสบการณ์ของผู้ใช้และความปลอดภัย
ความสามารถในการเขียนโค้ดและคณิตศาสตร์ Inflection-2.5 ส่องแสงในการเขียนโค้ดและคณิตศาสตร์ โดยแสดงการปรับปรุงมากกว่า 10% เมื่อเทียบกับ Inflection-1 ใน BIG-Bench-Hard ซับเซตของปัญหาที่ท้าทายสำหรับโมเดลภาษาขนาดใหญ่ สองแบ่งชมาร์กการเขียนโค้ด MBPP+ และ HumanEval+ แสดงให้เห็นถึงการปรับปรุงที่สำคัญเมื่อเทียบกับ Inflection-1 โดยยืนยันความสามารถของ Inflection-2.5 ในด้านการเขียนโค้ด
ในแบ่งชมาร์ก MBPP+ Inflection-2.5 มีผลการทำงานที่เหนือกว่า Inflection-1 โดยมีระดับการทำงานที่ใกล้เคียงกับ GPT-4 ตามที่รายงานโดย DeepSeek Coder ในทำนองเดียวกัน ในแบ่งชมาร์ก HumanEval+ Inflection-2.5 แสดงให้เห็นถึงความก้าวหน้าที่น่าประทับใจ โดยเอาชนะ Inflection-1 และเข้าใกล้ระดับการทำงานของ GPT-4 ตามที่รายงานใน EvalPlus leaderboard
อุตสาหกรรม Benchmark Dominance
Inflection-2.5 ยืนออกในแบ่งชมาร์กอุตสาหกรรม โดยแสดงให้เห็นถึงการปรับปรุงที่สำคัญเมื่อเทียบกับ Inflection-1 ในแบ่งชมาร์ก MMLU และ GPQA Diamond ซึ่งมีความท้าทายระดับ chuyên家 ผลการทำงานของโมเดลบนแบ่งชมาร์กเหล่านี้เน้นย้ำถึงความสามารถในการจัดการงานที่หลากหลาย ตั้งแต่ปัญหาในระดับมัธยมจนถึงความท้าทายระดับมืออาชีพ
ความสามารถในการสอบ STEM Inflection-2.5 มีผลการทำงานที่โดดเด่นในด้านการสอบ STEM รวมถึงการสอบคณิตศาสตร์ฮังการีและ Physics GRE ในการสอบคณิตศาสตร์ฮังการี Inflection-2.5 แสดงให้เห็นถึงความสามารถด้านคณิตศาสตร์โดยใช้คำสั่ง few-shot และรูปแบบที่ให้มา ทำให้ง่ายต่อการทำซ้ำ
ใน Physics GRE การสอบเข้าระดับบัณฑิตศึกษาในสาขาฟิสิกส์ Inflection-2.5 เข้าใกล้ระดับ 85 เปอร์เซ็นต์ของผู้สอบ人类ใน maj@8 (เสียงส่วนใหญ่ที่ 8) โดยยืนยันความสามารถในการแก้ปัญหา物理ที่ซับซ้อนด้วยความแม่นยำสูง นอกจากนี้ โมเดลยังเข้าใกล้คะแนนสูงสุดใน maj@32 โดยแสดงให้เห็นถึงความสามารถในการจัดการปัญหา物理ที่ซับซ้อน
การปรับปรุงประสบการณ์ของผู้ใช้ Inflection-2.5 ไม่เพียงแต่คงไว้ซึ่งบุคลิกที่เห็นอกเห็นใจและมาตรฐานความปลอดภัยของ Pi แต่ยังยกระดับสถานะของมันเป็น AI ส่วนบุคคลที่มีคุณค่าและหลากหลายหัวข้อ ตั้งแต่การอภิปรายเหตุการณ์ปัจจุบัน การแนะนำท้องถิ่น การศึกษาสำหรับการสอบ การเขียนโค้ด และแม้กระทั่งการสนทนาทั่วไป Pi ที่ได้รับการสนับสนุนจาก Inflection-2.5 สัญญาว่าจะให้ประสบการณ์ที่ดีขึ้นสำหรับผู้ใช้
ด้วยความสามารถที่แข็งแกร่งของ Inflection-2.5 ผู้ใช้สามารถมีปฏิสัมพันธ์กับ Pi ในหัวข้อที่หลากหลายกว่าเดิม ความสามารถของโมเดลในการจัดการงานที่ซับซ้อน รวมถึงบุคลิกที่เห็นอกเห็นใจและความสามารถในการค้นหาทางอินเทอร์เน็ตแบบเรียลไทม์ ทำให้ผู้ใช้รับข้อมูลและคำแนะนำที่มีคุณภาพสูงและทันสมัย
การยอมรับและความผูกพันของผู้ใช้ ผลกระทบของการรวม Inflection-2.5 เข้ากับ Pi ได้แสดงให้เห็นแล้วในด้านความรู้สึกของผู้ใช้ การมีส่วนร่วม และการรักษาผู้ใช้ Inflection AI ได้เห็นการเติบโตของจำนวนผู้ใช้ที่ใช้งานอยู่ทุกวันและทุกเดือน โดยมีผู้ใช้มากกว่าหนึ่งล้านคนต่อวันและหกล้านคนต่อเดือนที่มีปฏิสัมพันธ์กับ Pi มากกว่า 4 พันล้านครั้ง
โดยเฉลี่ย การสนทนากับ Pi จะใช้เวลา 33 นาที โดยมีหนึ่งในสิบที่ใช้เวลาเกินหนึ่งชั่วโมงทุกวัน นอกจากนี้ ประมาณ 60% ของผู้ที่มีปฏิสัมพันธ์กับ Pi ในสัปดาห์หนึ่งจะกลับมาอีกครั้งในสัปดาห์ถัดไป โดยแสดงให้เห็นถึงความเหนียวแน่นในเดือนที่สูงกว่าผู้นำในอุตสาหกรรม
รายละเอียดทางเทคนิคและความโปร่งใสของ Benchmark
ตามความมุ่งมั่นของ Inflection AI ในด้านความโปร่งใสและความสามารถในการทำซ้ำได้ บริษัทได้เผยแพร่ผลลัพธ์ทางเทคนิคและรายละเอียดเกี่ยวกับผลการทำงานของ Inflection-2.5 บนหลายแบ่งชมาร์กอุตสาหกรรม
ตัวอย่างเช่น ในเวอร์ชันที่แก้ไขแล้วของชุดข้อมูล MT-Bench ซึ่งแก้ไขปัญหาการอ้างอิงที่ไม่ถูกต้องและสมมติฐานที่มีข้อบกพร่องในข้อมูลดั้งเดิม Inflection-2.5 แสดงผลการทำงานที่สอดคล้องกับความคาดหวังตามแบ่งชมาร์กอื่น ๆ
Inflection AI ยังประเมิน Inflection-2.5 บน HellaSwag และ ARC-C ซึ่งเป็นแบ่งชมาร์กทั่วไปที่ใช้สำหรับการทดสอบความเข้าใจทั่วไปและวิทยาศาสตร์ ผลลัพธ์แสดงให้เห็นถึงผลการทำงานที่แข็งแกร่งในแบ่งชมาร์กเหล่านี้
เป็นสิ่งสำคัญที่จะต้องทราบว่าแม้ว่าการประเมินเหล่านี้จะแสดงถึงโมเดลที่ใช้ในการให้บริการ Pi แต่ประสบการณ์ของผู้ใช้อาจแตกต่างเล็กน้อยเนื่องจากปัจจัยต่าง ๆ เช่น ผลกระทบของการค้นหาทางอินเทอร์เน็ต (ไม่ได้ใช้ในแบ่งชมาร์ก) การจัดโครงสร้างของ few-shot prompting และความแตกต่างอื่น ๆ ในการผลิต
สรุป
Inflection-2.5 เป็นตัวแทนของก้าวสำคัญในด้านโมเดลภาษาขนาดใหญ่ โดยมีความสามารถที่ใกล้เคียงกับ GPT-4 และ Gemini ในขณะที่ใช้ทรัพยากรการคำนวณเพียงเศษเสี้ยวเท่านั้น ด้วยผลการทำงานที่น่าประทับใจบนหลายแบ่งชมาร์ก โดยเฉพาะในด้าน STEM การเขียนโค้ด และคณิตศาสตร์ Inflection-2.5 ได้แสดงให้เห็นถึงความสามารถที่แข็งแกร่งในด้าน AI
การรวม Inflection-2.5 เข้ากับ Pi โมเดล AI ส่วนบุคคลของ Inflection AI สัญญาว่าจะให้ประสบการณ์ที่ดีขึ้นสำหรับผู้ใช้ โดยรวมพลังการทำงานด้วยบุคลิกที่เห็นอกเห็นใจและมาตรฐานความปลอดภัย ในขณะที่ Inflection AI ยังคงผลักดันขอบเขตของความเป็นไปได้ในด้าน LLM ชุมชน AI ต่างรอคอยการ 혁신และความก้าวหน้าต่อไปจากบริษัทที่มีวิสัยทัศน์นี้














