โมเดลและแพลตฟอร์ม AI
สแต็ค AI ไฮบริดของ Apple Intelligence: ทำไม Gemini ชนะบทบาทหลัก
Unite.AI อาจได้รับค่าตอบแทนเมื่อคุณใช้ลิงก์ไปยังผลิตภัณฑ์ที่เรารีวิว ทั้งนี้ไม่ส่งผลต่อการประเมินของกองบรรณาธิการ อ่าน การเปิดเผยข้อมูลพันธมิตรของเรา.
ในช่วงปีที่ผ่านมา อุตสาหกรรมปัญญาประดิษฐ์ได้ชมการแข่งขันหมากรุกที่มีเดิมพันสูงระหว่าง OpenAI, Google (GOOGL ) และ Anthropic ทั้งหมดต้องการที่ดินมีค่าที่สุดในเทคโนโลยีของผู้บริโภค: ชั้นเริ่มต้นของ iPhone เมื่อวันที่ 12 มกราคม 2026 การแข่งขันสิ้นสุดลง Apple (AAPL ) และ Google ยืนยัน ข้อตกลงหุ้นส่วนหลายปีเพื่อผสานรวม Gemini เข้ากับแก่นกลางของ Apple Intelligence
นี่ไม่ใช่แค่การเปลี่ยนผู้ขาย แต่เป็นการเปลี่ยนแปลงโครงสร้างพื้นฐานว่า AI จะทำงานบน iOS อย่างไร ในขณะที่การประกาศ WWDC ในตอนแรกเน้นไปที่ ChatGPT ยุทธวิธีระยะยาวของ Apple ต้องการหุ้นส่วนที่สามารถให้ไม่เพียงแค่ช่องแชท แต่ยังเป็นเครื่องมือให้เหตุผลแบบหลายรูปแบบที่สามารถจัดการคำถามหลายพันล้านรายวันด้วยความล่าช้าที่ต่ำได้ Gemini ของ Google ที่ได้รับการสนับสนุนจากโครงสร้างพื้นฐาน TPU ที่กำหนดเองได้พิสูจน์แล้วว่าเป็นรุ่นเดียวที่พร้อมสำหรับการใช้งานในระดับนี้
สแต็ค AI ไฮบริดอธิบาย
การผสานรวมนี้แนะนำโครงสร้างสามชั้นที่ซับซ้อนสำหรับ Apple Intelligence ซึ่งออกแบบมาเพื่อสร้างสมดุลระหว่างความเป็นส่วนตัวและพลังงานดิบ การทำความเข้าใจสแต็คนี้เป็นกุญแจสำคัญในการทำความเข้าใจว่าทำไม Gemini ถึงถูกเลือกมากกว่า GPT-4o หรือ Claude
1. โมเดลบนอุปกรณ์ (ชั้น Edge)
สำหรับงานประจำวันประมาณ 60% – การจัดเรียงการแจ้งเตือน การเขียนข้อความใหม่ หรือการค้นหาข้อมูลแอปท้องถิ่น – Apple จะยังคงใช้โมเดล 3B และ 7B ที่เป็นของตนเองซึ่งทำงานบน Neural Engine (NPU) ท้องถิ่น ซึ่งรับประกันความล่าช้าที่เป็นศูนย์และความเป็นส่วนตัวที่สมบูรณ์สำหรับข้อมูลส่วนบุคคล
2. การคำนวณคลาวด์ส่วนตัว (สะพานความเป็นส่วนตัว)
เมื่อคำขอซับซ้อนเกินไปสำหรับโทรศัพท์แต่ต้องการข้อมูลที่ละเอียดอ่อน (เช่น “ตรวจสอบปฏิทินและจองโต๊ะ”) จะถูกส่งไปยัง Private Cloud Compute (PCC) ของ Apple เซิร์ฟเวอร์เหล่านี้ใช้ LLM ที่ไม่เก็บข้อมูล
3. Gemini (ชั้นความรู้ของโลก)
นี่คือจุดที่การเป็นหุ้นส่วนใหม่เข้ามา โดยสำหรับคำถาม “ความรู้ของโลก” – การให้เหตุผลที่ซับซ้อน การสร้างสรรค์ หรือการค้นหาข้อมูลในเวลาจริง – Siri จะส่งต่อคำขอไปยัง Gemini อย่างไม่มีการหยุดชะงัก ไม่เหมือนกับการใช้งานก่อนหน้านี้ที่ผู้ใช้ต้องยืนยัน “คุณต้องการใช้ ChatGPT หรือไม่” Gemini ถูกผสานรวมเป็นกระบวนการระบบพื้นฐาน
ทำไม Google ชนะชั้น OS
การตัดสินใจที่จะถอด OpenAI ออกและเลือก Google ลงมาจากสามปัจจัยที่สำคัญ: โครงสร้างพื้นฐาน การทำงานหลายรูปแบบ และบริบท
- การบูรณาการแนวตั้ง: OpenAI พึ่งพาโครงสร้างพื้นฐาน Azure ของ Microsoft และ GPU ของ Nvidia Google ควบคุมสแต็คทั้งหมดตั้งแต่โมเดล Gemini ลงไปจนถึง TPU ที่กำหนดเอง Trillium ในศูนย์ข้อมูลของตนเอง ซึ่งช่วยให้ Google สามารถให้การรับประกันการผ่านข้อมูลและความล่าช้าที่ต่ำกว่าให้กับ Apple ซึ่งเป็นราคา basis ที่ OpenAI อาจไม่เทียบได้
- การทำงานหลายรูปแบบที่เป็นเจ้าของ: Gemini ได้รับการฝึกอบรมที่มีการทำงานหลายรูปแบบที่เป็นเจ้าของ โดยใช้ข้อมูลวิดีโอ เสียง และข้อความพร้อมกัน ในขณะที่ Siri พัฒนาต่อไปเพื่อเป็นตัวแทนการที่สามารถ “เห็น” สิ่งที่อยู่บนหน้าจอและ “ได้ยิน” บริบทที่ล้อมรอบ Gemini มีโครงสร้างพื้นฐานที่เหมาะสมกว่าสำหรับคุณสมบัติเหล่านี้มากกว่าการนำโมเดลที่แยกจากกันมาเชื่อมต่อ
- อนาคต “Agentic”: แฟร์มเวิร์ก “App Intents” ของ Apple ต้องการ AI ที่สามารถวางแผนการกระทำหลายขั้นตอนระหว่างแอปพลิเคชันต่างๆ Google ได้ใช้เวลาหนึ่งปีในการปรับ Gemini ให้เหมาะสมกับ การทำงานแบบ Agentic (การวางแผน การให้เหตุผล และการใช้เครื่องมือ) ซึ่งตรงกับแผนการของ Apple สำหรับ Siri 2.0
ความเป็นจริงใหม่ของ OpenAI: ยุค “Plugin”
สำหรับ OpenAI การประกาศครั้งนี้ถือเป็นการหดตัวเชิงกลยุทธ์ที่มีนัยสำคัญ ในขณะที่บริษัทของ Sam Altman ยังคงเป็นผู้นำในด้านความสามารถของโมเดลที่บริสุทธิ์ การสูญเสียช่องทางเริ่มต้นบน iOS จะจำกัดการเข้าถึง “หน้าต่างบริบท” ของชีวิตของผู้บริโภคโดยเฉลี่ย
ChatGPT จะยังคงมีอยู่บน iOS แต่จะกลายเป็น “ปลั๊กอิน” หรือทักษะพิเศษ – เหมือนกับวิธีการทำงานของ Wikipedia หรือ WolframAlpha ในปัจจุบัน ผู้ใช้สามารถเรียกใช้สำหรับงานเขียนสร้างสรรค์หรือการช่วยเหลือในการเขียนโค้ด แต่จะไม่ได้เป็นสมองอันแข็งแกร่งที่ขับเคลื่อนการโต้ตอบประจำวันของระบบปฏิบัติการอีกต่อไป
วิศวกรรมความเป็นส่วนตัวเป็นไฟร์วอลล์
ผู้สังเกตการณ์ที่มีความรู้ด้านเทคนิคแสดงความกังวลทันทีเกี่ยวกับ Google – บริษัทโฆษณาที่ใช้ข้อมูล – ที่ได้รับ quyềnเข้าถึงคำถามของ iPhone อย่างไรก็ตาม การใช้งานทางเทคนิคชี้ให้เห็นว่ามีไฟร์วอลล์ที่เข้มงวด
การกำหนดเส้นทางคำขอของ Apple ทำให้ข้อมูลถูกทำให้ไม่ระบุชื่อก่อนที่จะถึงเซิร์ฟเวอร์ของ Google ที่อยู่ IP ถูกปิดบัง และ “บริบท” ที่ส่งไปยัง Gemini ถูกถอดออกจากตัวระบุส่วนบุคคลที่สำคัญ สัญญาอนุญาตนี้ห้าม Google ไม่ให้ใช้การจราจรที่มาจาก Apple เพื่อฝึกโมเดลของตน สำหรับ Google คุณค่าไม่ได้อยู่ในข้อมูล แต่อยู่ในกระบวนการทำให้ Gemini เป็นมาตรฐานสาธารณูปโภคสำหรับ AI ซึ่งป้องกันไม่ให้ผู้ใช้เปลี่ยนไปใช้แอปพลิเคชันของบุคคลที่สาม
สิ่งนี้หมายถึงอะไรสำหรับนักพัฒนา
สำหรับระบบนักพัฒนา การรวมกันนี้นำมาซึ่งความมั่นคง Framework CoreML และ App Intents ของ Apple จะได้รับการปรับให้ทำงานร่วมกับ Gemini อย่างราบรื่น นักพัฒนาที่สร้างแอปพลิเคชันที่ “รู้จัก Siri” สามารถคาดหวังพฤติกรรมที่สม่ำเสมอมากขึ้นในขณะที่ AI ตีความเจตนาของผู้ใช้และดำเนินการคำสั่งที่ซับซ้อน
เราน่าจะเห็นความเจริญรุ่งเรืองของ “แอป Agentic” – แอปพลิเคชันที่ออกแบบไม่เพียงแต่สำหรับการใช้งานโดยมนุษย์ แต่ยังควบคุมโดย Siri ที่ได้รับการเสริมพลังจาก Gemini อีกด้วย ไม่ว่าจะเป็นการจองการเดินทางที่ซับซ้อน การวางแผนการเงินอัตโนมัติ หรือการสร้างเนื้อหาที่มีการทำงานร่วมกันระหว่างแอปพลิเคชัน รางทางสำหรับตัวแทน AI ที่แท้จริงบนมือถือกำลังถูกวางไว้แล้ว
สรุป: การรวมกันของ duopoly
สงคราม AI ในปี 2024 และ 2025 ถูกกำหนดโดยการแข่งขันเพื่อความเป็นเจ้าของโมเดล ปี 2026 กำลังกำหนดช่องทางการกระจาย โดยการเลือก Google Apple ได้สร้างความเป็นจริงที่ทั้งสองระบบปฏิบัติการมือถือที่ใหญ่ที่สุดถูกขับเคลื่อนโดย
สำหรับอุตสาหกรรม สิ่งนี้แสดงให้เห็นว่าการเป็นเจ้าของ “ไมล์สุดท้าย” ถึงผู้ใช้มีความสำคัญไม่แพ้กับการมีโมเดลที่ฉลาดที่สุดในห้องปฏิบัติการ Gemini อาจไม่ได้เริ่มต้นเป็นผู้บุกเบิก แต่ด้วยการรักษาความปลอดภัยของ iPhone ได้สำเร็จ จึงกลายเป็นสมองการทำงานมาตรฐานของเว็บมือถือไปโดยปริยาย












