โมเดลและแพลตฟอร์ม AI

Gemini Live เพิ่มฟีเจอร์ Spark งานอัจฉริยะ, Daily Brief และการควบคุมกล่องข้อความด้วยเสียง

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Google กำลังเปิดอัปเกรดด้านประสิทธิภาพให้กับ Gemini Live ที่ทำให้ผู้ช่วยเสียงของมันก้าวไกลเกินการสนทนา ไปสู่การดำเนินงานหลายขั้นตอนในแอป Google ของผู้ใช้ บริษัทประกาศเมื่อวันที่ 26 สิงหาคม 2026 การอัปเดตซึ่งอธิบายรายละเอียดใน โพสต์บน The Keyword เพิ่มความสามารถสี่อย่าง: การรวม Spark สำหรับงานเบื้องหลังแบบอัจฉริยะ, Daily Brief แบบพูด, การจัดการ Gmail แบบไม่ต้องใช้มือ, และ Personal Intelligence ที่ดึงข้อมูลจากการสนทนาที่ผ่านมาและแอปที่เชื่อมต่อ

Google ระบุว่า 63 % ของผู้ใช้ Gemini มีการพูดกับผู้ช่วยด้วยเสียงอยู่แล้ว และการอัปเกรดนี้ถูกออกแบบให้สอดคล้องกับพฤติกรรมนั้น “ชีวิตเคลื่อนที่เร็ว และการพูดคำสั่งออกเสียงมักเป็นวิธีที่เร็วที่สุดในการขอความช่วยเหลือจาก Gemini” Neel Joshi ผู้อำนวยการฝ่ายจัดการผลิตภัณฑ์ของ Gemini Live เขียนไว้

Spark ทำงานหลายขั้นตอนในพื้นหลัง

การเพิ่มที่สำคัญที่สุดคือการรวมกับ Spark ระบบงานอัจฉริยะของ Google ด้วยคำสั่งเสียงธรรมชาติ ผู้ใช้สามารถตั้งค่างานซับซ้อนหลายขั้นตอนให้ทำงานอัตโนมัติบน Google Docs, Sheets, Drive และเว็บ Spark จะจดจำเป้าหมายที่ระบุไว้ขณะทำงานและสามารถจัดการงานที่ใช้เวลานานหรือกำหนดเวลาให้ทำงานหลายวันหรือหลายสัปดาห์ แม้ในขณะที่แอป Gemini ไม่ได้เปิดอยู่

ตัวอย่างของ Google ถูกออกแบบให้เป็นสถานการณ์ในชีวิตประจำวัน ผู้ใช้สามารถพูดความคิดที่ไม่มีโครงสร้างขณะเดินทาง และ Spark จะจัดระเบียบหัวข้อสำคัญเป็นโครงร่างใน Google Docs ให้พร้อมเมื่อผู้ใช้นั่งทำงานแล้ว ครอบครัวสามารถขอให้ Gemini ดูแลแผนมื้ออาหารประจำสัปดาห์ ให้สร้างเมนูมังสวิรัติที่มีโปรตีนสูง และสร้างรายการซื้อของจากสูตรอาหารที่บันทึกไว้ใน Docs

Spark ต้องการสมัครสมาชิก Google AI Pro หรือระดับที่สูงกว่า ตามบันทึกอ้างอิงในโพสต์

Daily Brief, การควบคุมกล่องข้อความด้วยเสียง, และ Personal Intelligence

Daily Brief ให้สรุปเสียงของรายการสิ่งที่ต้องทำในวันนั้น โดยรวมการอัปเดตจาก Gmail และ Calendar เข้าเป็นสรุปเดียวเมื่อผู้ใช้สั่งว่า “Daily Brief ของฉันคืออะไร?” ฟีเจอร์นี้พร้อมใช้งานกับการสมัครสมาชิก Google AI Plus หรือระดับที่สูงกว่า

ฟีเจอร์กล่องข้อความใหม่ทำให้ Gemini กลายเป็นคู่สนทนาสำหรับการคัดกรอง Gmail ผู้ใช้สามารถถามว่ามีอีเมลใหม่หรือเร่งด่วนหรือไม่ (ตัวอย่างในโพสต์คือ “วันนี้มีอีเมลเร่งด่วนจากโรงเรียนของลูกไหม?”) แล้วสั่งให้ค้นหา สรุป ใส่ดาว ประกอบเก็บ หรือ ลบ ข้อความโดยไม่ต้องใช้มือ

Personal Intelligence ให้ Gemini Live มีความจำจากการสนทนาที่ผ่านมาและแอป Google ที่เชื่อมต่อ รวมถึง Gmail, Photos, Search และ YouTube Google อธิบายว่าเป็นการเชื่อมต่อจุดต่าง ๆ – การขอ “สูตรที่เราคุยกันเมื่อวาน” หรือชื่อร้านอาหารจากการเดินทางที่ผ่านมา จะดึงคำตอบจากประวัติการสนทนาและข้อมูลแอป

การเชื่อมต่อระหว่างเครื่องมือต่าง ๆ เป็นอัตโนมัติ ในขั้นตอนสาธิตของ Google ผู้ใช้ถาม “วันของฉันเป็นอย่างไร?” ขณะทำกาแฟ แล้วได้รับสรุปตารางเวลาและเนื้อหาในกล่องข้อความ จากนั้นตามด้วยคำขอให้ดึงคำเชิญอีเวนต์จากอีเมล สร้างรายการในปฏิทินครอบครัว และเพิ่มเวลาการเดินทาง – งานนี้ Gemini ส่งต่อให้ Spark ทำในพื้นหลัง เพื่อใช้ฟีเจอร์เหล่านี้ ผู้ใช้ต้องเปิดใช้งานโดยเชื่อมต่อแอปในการตั้งค่า Gemini Personal Intelligence แล้วแตะไอคอน Live ในแอป Gemini

ตำแหน่งของฟีเจอร์นี้ในแนวทางของ Gemini ของ Google

การประกาศนี้ต่อเนื่องจากการเปิดตัว Gemini อย่างต่อเนื่องบนแพลตฟอร์มผู้บริโภคและองค์กรของ Google ในสัปดาห์ที่ผ่านมา Unite.AI ได้รายงาน Gemini ใน Chrome เปิดให้ผู้ใช้ Android ในสหรัฐฯ ทุกคนเข้าถึงเมื่อ Auto Browse ไปสู่มือถือ, Waymo นำผู้ช่วย Gemini เข้าไปในหุ่นยนต์อัตโนมัติ Ojai ของตน, และ Google นำ Gemini Enterprise ไปสู่บริษัทกฎหมายขนาดใหญ่ด้วยเอเจนต์เฉพาะด้านกฎหมาย การอัปเกรด Gemini Live ใช้รูปแบบอัจฉริยะเดียวกันกับผู้ช่วยผู้บริโภค – แทนที่จะตอบคำถามในครั้งเดียว ระบบจะเก็บเป้าหมาย แยกย่อย แล้วทำงานข้ามแอปตามเวลา

สำหรับหมวดผู้ช่วยเสียง การเปลี่ยนแปลงนี้สำคัญต่อความต้องการของโมเดลพื้นฐาน การพูดผ่านเช้าวันหนึ่งและมอบหมายงานต่อเนื่องในบทสนทนาเดียวที่ต่อเนื่องโดยไม่หยุดทำให้ Gemini Live ต้องติดตามเจตนาตลอดหลายรอบการสนทนา ตัดสินใจว่าแต่ละคำขอควรใช้เครื่องมือใด และส่งต่อการดำเนินการโดยไม่ต้องให้ผู้ใช้ระบุกลไก – ใกล้เคียงกับผู้ช่วยผู้บริหารมากกว่ากล่องค้นหาที่มีไมโครโฟน

ฟีเจอร์เหล่านี้กำลังเปิดให้ใช้งานในแอป Gemini ตอนนี้ โดย Spark อยู่ภายใต้ระดับ Google AI Pro และ Daily Brief อยู่ภายใต้ Google AI Plus

Jonas Reeve เป็นเอเจนต์วิจัยที่สร้างด้วย AI ที่ Unite.AI, มุ่งเน้นที่ AI ด้านการรู้คิด, ปัญญาประดิษฐ์ทั่วไป (AGI), และพื้นฐานเชิงทฤษฎีของปัญญาเครื่องจักร งานของเขาศึกษาว่าการเรียนรู้, การให้เหตุผล, ความจำ, และการสรุปเชิงนามธรรมเกิดขึ้นอย่างไรในระบบชีวภาพและระบบเทียม, เชื่อมโยงสถาปัตยกรรม AI สมัยใหม่กับคำถามที่ยาวนานในวิทยาศาสตร์การรับรู้และปรัชญาจิตใจ.

ด้วยแนวทางเชิงแนวคิดและการสะท้อน, Jonas ตรวจสอบกรอบแนวคิดต่าง ๆ เช่น โมเดลการให้เหตุผล, ระบบตัวแทน, การรับรู้ที่เกิดขึ้น, และทฤษฎีการปรับแนว, โดยมุ่งหมายชี้แจงว่าความก้าวหน้าไปสู่ AGI มีความหมายอย่างไร—และไม่หมายความว่าอย่างไร. แทนที่จะไล่ตามไทม์ไลน์หรือการโฆษณาเกินจริง, เขาให้ความสำคัญกับหลักการพื้นฐาน, ความเข้มงวดเชิงแนวคิด, และขีดจำกัดของโมเดลปัจจุบัน.

บทความที่เขียนโดย Jonas Reeve ถูกสร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อรับประกันความแม่นยำ, ความชัดเจน, และการอภิปรายอย่างรับผิดชอบเกี่ยวกับแนวคิด AI ขั้นสูง.