โมเดลและแพลตฟอร์ม AI

Gemini Live เพิ่มฟีเจอร์ Spark งานอัจฉริยะ, Daily Brief และการควบคุมกล่องข้อความด้วยเสียง

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Google กำลังเปิดอัปเกรดด้านประสิทธิภาพให้กับ Gemini Live ที่ทำให้ผู้ช่วยเสียงของมันก้าวไกลเกินการสนทนา ไปสู่การดำเนินงานหลายขั้นตอนในแอป Google ของผู้ใช้ บริษัทประกาศเมื่อวันที่ 26 สิงหาคม 2026 การอัปเดตซึ่งอธิบายรายละเอียดใน โพสต์บน The Keyword เพิ่มความสามารถสี่อย่าง: การรวม Spark สำหรับงานเบื้องหลังแบบอัจฉริยะ, Daily Brief แบบพูด, การจัดการ Gmail แบบไม่ต้องใช้มือ, และ Personal Intelligence ที่ดึงข้อมูลจากการสนทนาที่ผ่านมาและแอปที่เชื่อมต่อ

Google ระบุว่า 63 % ของผู้ใช้ Gemini มีการพูดกับผู้ช่วยด้วยเสียงอยู่แล้ว และการอัปเกรดนี้ถูกออกแบบให้สอดคล้องกับพฤติกรรมนั้น “ชีวิตเคลื่อนที่เร็ว และการพูดคำสั่งออกเสียงมักเป็นวิธีที่เร็วที่สุดในการขอความช่วยเหลือจาก Gemini” Neel Joshi ผู้อำนวยการฝ่ายจัดการผลิตภัณฑ์ของ Gemini Live เขียนไว้

Spark ทำงานหลายขั้นตอนในพื้นหลัง

การเพิ่มที่สำคัญที่สุดคือการรวมกับ Spark ระบบงานอัจฉริยะของ Google ด้วยคำสั่งเสียงธรรมชาติ ผู้ใช้สามารถตั้งค่างานซับซ้อนหลายขั้นตอนให้ทำงานอัตโนมัติบน Google Docs, Sheets, Drive และเว็บ Spark จะจดจำเป้าหมายที่ระบุไว้ขณะทำงานและสามารถจัดการงานที่ใช้เวลานานหรือกำหนดเวลาให้ทำงานหลายวันหรือหลายสัปดาห์ แม้ในขณะที่แอป Gemini ไม่ได้เปิดอยู่

ตัวอย่างของ Google ถูกออกแบบให้เป็นสถานการณ์ในชีวิตประจำวัน ผู้ใช้สามารถพูดความคิดที่ไม่มีโครงสร้างขณะเดินทาง และ Spark จะจัดระเบียบหัวข้อสำคัญเป็นโครงร่างใน Google Docs ให้พร้อมเมื่อผู้ใช้นั่งทำงานแล้ว ครอบครัวสามารถขอให้ Gemini ดูแลแผนมื้ออาหารประจำสัปดาห์ ให้สร้างเมนูมังสวิรัติที่มีโปรตีนสูง และสร้างรายการซื้อของจากสูตรอาหารที่บันทึกไว้ใน Docs

Spark ต้องการสมัครสมาชิก Google AI Pro หรือระดับที่สูงกว่า ตามบันทึกอ้างอิงในโพสต์

Daily Brief, การควบคุมกล่องข้อความด้วยเสียง, และ Personal Intelligence

Daily Brief ให้สรุปเสียงของรายการสิ่งที่ต้องทำในวันนั้น โดยรวมการอัปเดตจาก Gmail และ Calendar เข้าเป็นสรุปเดียวเมื่อผู้ใช้สั่งว่า “Daily Brief ของฉันคืออะไร?” ฟีเจอร์นี้พร้อมใช้งานกับการสมัครสมาชิก Google AI Plus หรือระดับที่สูงกว่า

ฟีเจอร์กล่องข้อความใหม่ทำให้ Gemini กลายเป็นคู่สนทนาสำหรับการคัดกรอง Gmail ผู้ใช้สามารถถามว่ามีอีเมลใหม่หรือเร่งด่วนหรือไม่ (ตัวอย่างในโพสต์คือ “วันนี้มีอีเมลเร่งด่วนจากโรงเรียนของลูกไหม?”) แล้วสั่งให้ค้นหา สรุป ใส่ดาว ประกอบเก็บ หรือ ลบ ข้อความโดยไม่ต้องใช้มือ

Personal Intelligence ให้ Gemini Live มีความจำจากการสนทนาที่ผ่านมาและแอป Google ที่เชื่อมต่อ รวมถึง Gmail, Photos, Search และ YouTube Google อธิบายว่าเป็นการเชื่อมต่อจุดต่าง ๆ – การขอ “สูตรที่เราคุยกันเมื่อวาน” หรือชื่อร้านอาหารจากการเดินทางที่ผ่านมา จะดึงคำตอบจากประวัติการสนทนาและข้อมูลแอป

การเชื่อมต่อระหว่างเครื่องมือต่าง ๆ เป็นอัตโนมัติ ในขั้นตอนสาธิตของ Google ผู้ใช้ถาม “วันของฉันเป็นอย่างไร?” ขณะทำกาแฟ แล้วได้รับสรุปตารางเวลาและเนื้อหาในกล่องข้อความ จากนั้นตามด้วยคำขอให้ดึงคำเชิญอีเวนต์จากอีเมล สร้างรายการในปฏิทินครอบครัว และเพิ่มเวลาการเดินทาง – งานนี้ Gemini ส่งต่อให้ Spark ทำในพื้นหลัง เพื่อใช้ฟีเจอร์เหล่านี้ ผู้ใช้ต้องเปิดใช้งานโดยเชื่อมต่อแอปในการตั้งค่า Gemini Personal Intelligence แล้วแตะไอคอน Live ในแอป Gemini

ตำแหน่งของฟีเจอร์นี้ในแนวทางของ Gemini ของ Google

การประกาศนี้ต่อเนื่องจากการเปิดตัว Gemini อย่างต่อเนื่องบนแพลตฟอร์มผู้บริโภคและองค์กรของ Google ในสัปดาห์ที่ผ่านมา Unite.AI ได้รายงาน Gemini ใน Chrome เปิดให้ผู้ใช้ Android ในสหรัฐฯ ทุกคนเข้าถึงเมื่อ Auto Browse ไปสู่มือถือ, Waymo นำผู้ช่วย Gemini เข้าไปในหุ่นยนต์อัตโนมัติ Ojai ของตน, และ Google นำ Gemini Enterprise ไปสู่บริษัทกฎหมายขนาดใหญ่ด้วยเอเจนต์เฉพาะด้านกฎหมาย การอัปเกรด Gemini Live ใช้รูปแบบอัจฉริยะเดียวกันกับผู้ช่วยผู้บริโภค – แทนที่จะตอบคำถามในครั้งเดียว ระบบจะเก็บเป้าหมาย แยกย่อย แล้วทำงานข้ามแอปตามเวลา

สำหรับหมวดผู้ช่วยเสียง การเปลี่ยนแปลงนี้สำคัญต่อความต้องการของโมเดลพื้นฐาน การพูดผ่านเช้าวันหนึ่งและมอบหมายงานต่อเนื่องในบทสนทนาเดียวที่ต่อเนื่องโดยไม่หยุดทำให้ Gemini Live ต้องติดตามเจตนาตลอดหลายรอบการสนทนา ตัดสินใจว่าแต่ละคำขอควรใช้เครื่องมือใด และส่งต่อการดำเนินการโดยไม่ต้องให้ผู้ใช้ระบุกลไก – ใกล้เคียงกับผู้ช่วยผู้บริหารมากกว่ากล่องค้นหาที่มีไมโครโฟน

ฟีเจอร์เหล่านี้กำลังเปิดให้ใช้งานในแอป Gemini ตอนนี้ โดย Spark อยู่ภายใต้ระดับ Google AI Pro และ Daily Brief อยู่ภายใต้ Google AI Plus

จอนาส รีฟ เป็นนักวิเคราะห์ที่สร้างโดย AI ที่ Unite.AI โดยมุ่งเน้นไปที่ปัญญาประดิษฐ์แบบ认知 (Cognitive AI) ปัญญาประดิษฐ์ทั่วไป (Artificial General Intelligence - AGI) และรากฐานทางทฤษฎีของปัญญาประดิษฐ์ เขาได้สำรวจว่ากระบวนการเรียนรู้ การให้เหตุผล ความจำ และการสรุปผลเกิดขึ้นในระบบทางชีววิทยาและระบบประดิษฐ์ โดยเชื่อมโยงระหว่างโครงสร้าง AI สมัยใหม่และคำถามที่มีมานานในด้านวิทยาศาสตร์认知และปรัชญาของจิต

ด้วยแนวทางเชิงแนวคิดและสะท้อนกลับ จอนาสได้ตรวจสอบกรอบการทำงาน เช่น โมเดลการให้เหตุผล ระบบอージェนต์ การรับรู้ที่เกิดขึ้น และทฤษฎีการจัดตำแหน่ง โดยมีเป้าหมายเพื่อชี้แจงว่าการก้าวหน้าไปสู่ AGI หมายถึงอะไร และไม่หมายถึงอะไร โดยไม่ได้ตาม đuổiเส้นเวลาหรือการโฆษณา เขาเน้นย้ำถึงหลักการแรก การใช้เหตุผลเชิงแนวคิด และข้อจำกัดของโมเดลปัจจุบัน

บทความที่เขียนโดยจอนาส รีฟเป็นผลงานที่สร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อให้แน่ใจถึงความถูกต้อง ความชัดเจน และการอภิปรายที่มีความรับผิดชอบเกี่ยวกับแนวคิด AI ที่ทันสมัย