โมเดลและแพลตฟอร์ม AI

You.com ไฮไลท์การค้นหาเว็บทำคะแนน 95.17% ใน SimpleQA

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

You.com เมื่อวันที่ 1 กันยายน 2026 ได้เปิดโหมดการสกัดข้อมูลใหม่สำหรับ Web Search API ของตนที่ชื่อ Highlights โดยรายงานคะแนน 95.17% ในเกณฑ์ SimpleQA และลดต้นทุนการค้นหารวม 35% เมื่อเทียบกับการค้นหาเว็บในตัวของ Claude Sonnet 5 ในการประเมินอิสระ ฟีเจอร์นี้พร้อมใช้งานผ่านพารามิเตอร์ extraction_mode ของ API โดยมีราคา $5 CPM เหมือนกับบริการเดิม บริษัทกล่าว

สิ่งที่ Highlights ทำ

Web Search API คืนผลลัพธ์เว็บและข่าวที่มีโครงสร้างสำหรับแอปพลิเคชัน AI โดยค่าเริ่มต้น แต่ละผลลัพธ์จะมีอาร์เรย์ snippets ที่ประกอบด้วยข้อความสั้น ๆ ที่เน้นคีย์เวิร์ด การตั้งค่า extraction_mode เป็น highlights จะเปลี่ยนสแนปช็อตเหล่านั้นเป็นอาร์เรย์ contents.highlights ที่บรรจุข้อความจากแต่ละหน้าเพื่อตอบคำถามเฉพาะ

ตามที่ You.com ระบุ การสกัดข้อมูลทำงานต่อคำขอแต่ละครั้ง โดยแต่ละคำถามจะทำการสแกนหน้าใหม่ โมเดลจะระบุช่วงข้อความที่ตอบคำถามได้แล้วคืนผลลัพธ์แบบตรงตัว โดยคงรักษาตัวเลข วันที่ และตัวเลขสถิติไว้ตามที่ปรากฏในต้นฉบับ ตารางจะถูกส่งกลับพร้อมหัวตารางครบถ้วน บล็อกโค้ดจะคงรูปแบบเดิม และประโยคจากส่วนเดียวกันที่สำคัญทั้งสองจะถูกรวมเป็นข้อความเดียว ชุดข้อความที่เป็นผู้สมัครจะถูกจัดอันดับ โดยจะแสดงผลลัพธ์ที่อันดับสูงสุดก่อน

ผลลัพธ์ความแม่นยำ

You.com กล่าวว่าได้ทำการทดสอบสามชุดเกณฑ์บนโหมดการสกัดข้อมูลทั้งสามแบบ Highlights มีคะแนนสูงสุดใน SimpleQA ที่ 95.17% และใน RetrievalQA ที่ 66.93% ซึ่งเป็นเกณฑ์ที่อิงการค้นหาข้อเท็จจริงเดี่ยว ใน FRAMES ซึ่งเป็นเกณฑ์การให้เหตุผลหลายขั้นตอน การสกัดข้อมูลแบบเต็มหน้าได้คะแนน 82.77% เทียบกับ Highlights ที่ 82.04% ความต่าง 0.73 จุดนี้บริษัทอธิบายว่าอยู่ในช่วงความแปรผันระหว่างการรันที่สังเกตได้ในทดสอบนี้

บริษัทชี้ให้เห็นว่าการเพิ่มความแม่นยำไม่ได้มาฟรี: ต้นทุนต่อคำถามเพิ่มประมาณ 11% เมื่อเทียบกับ Snippets เนื่องจาก Highlights ส่งข้อความมากกว่าให้โมเดลตอบ อย่างไรก็ตามต้นทุนต่อคำตอบที่ถูกต้อง (คำนวณโดยหารต้นทุนด้วยความแม่นยำ) ยังต่ำกว่าประมาณ 5% ตามที่บริษัทกล่าว

เมื่อเปรียบเทียบกับระบบภายนอกใน SimpleQA, You.com รายงานว่ามีสามระบบที่ทำคะแนนเกิน 95%: You.com พร้อม Highlights ที่ 95.17% และความหน่วงเวลา p50 695ms, Exa (เต็มหน้า) ที่ 95.47% และ 1337ms, และ Parallel (ขั้นสูง) ที่ 95.33% และ 2098ms บริษัทกล่าวว่ามีการแสดงการตั้งค่าที่ทำงานดีที่สุดของแต่ละคู่แข่ง ดังนั้นการเปรียบเทียบจึงได้เปรียบต่อพวกเขาในแง่ของการตั้งค่า

การประเมินต้นทุนแบบอิสระ

Braintrust ในฐานะส่วนหนึ่งของ การประเมินแบบอิสระ ได้ทำการทดสอบ You.com Web Search พร้อม Highlights เทียบกับเครื่องมือค้นหาที่รวมอยู่ใน API ของ OpenAI และ Anthropic บนคำถามจำนวน 1,329 รายการ โดยคำนึงถึงต้นทุนทั้งการสรุปผลและการค้นหา

ในการประเมินนั้น Claude Sonnet 5 มีต้นทุน $0.0747 ต่อคำถามเมื่อใช้ Highlights เทียบกับ $0.1148 สำหรับการค้นหาในตัวของมันเอง ลดลง 35% โดยมีความแม่นยำที่สูงกว่าเล็กน้อย (79.23% เทียบกับ 78.78%) และเร็วกว่า 1.26 วินาที GPT-5.6 Terra มีต้นทุน $0.0417 ต่อคำถามเมื่อใช้ Highlights เทียบกับ $0.0467 ในตัว ลดลง 11% พร้อมความแม่นยำที่สูงกว่า 3.66 จุด ต้นทุนต่อคำตอบที่ถูกต้องลดลง 35% สำหรับ Claude และ 15% สำหรับ GPT เนื่องจาก Highlights ให้คำตอบที่ถูกต้องมากขึ้นโดยใช้จ่ายเท่าเดิมหรือค่าน้อยลง ตามที่ You.com รายงานผล

ข้อได้เปรียบด้านการสังเกต

You.com ให้เหตุผลว่าการค้นหาเว็บแบบแยกส่วนให้การสังเกตที่ดีกว่ามากกว่าเครื่องมือในตัวของ OpenAI และ Anthropic การค้นหาในตัวจะคืนค่าคำถามที่รันและหน้าที่อ้างอิง แต่ไม่แสดงข้อความที่โมเดลอ่าน บริษัทกล่าวว่า ทำให้ไม่สามารถทราบได้ว่าขั้นตอนใดทำให้เกิดคำตอบที่ผิดพลาด

บริษัทยกตัวอย่างคำถามจากการประเมินของ Braintrust ที่ถามว่าคาร์ลอส อัลคาราซเสียเกมเซอร์วิสกี่เกมในสองรอบการแข่งขันรวมกัน ซึ่งต้องบวกสองตัวเลขแยกกัน การตั้งค่า You.com ให้ผลลัพธ์เป็นข้อความหนึ่งที่ระบุค่าตัวแรกเป็น 24 และอีกข้อความหนึ่งที่ระบุค่าตัวที่สองเป็น 22 และโมเดลบวกกันได้คำตอบเป็น 46 ส่วนการรันที่พลาดไม่แสดงข้อความที่สนับสนุนค่า 24 ใช้ค่า 22 ทั้งสองค่าและให้คำตอบเป็น 44 ทุกการรันทำการคำนวณได้อย่างถูกต้อง ซึ่งบริษัทกล่าวว่าเป็นข้อเท็จจริงที่สามารถรู้ได้เพราะข้อความปรากฏในร่องรอย

เมื่อไม่ควรใช้

You.com กล่าวว่า Highlights เพิ่มเวลาโดยประมาณ 160ms เมื่อเทียบกับ Snippets ในการค้นหาแบบครั้งเดียว และภายใต้งบประมาณความหน่วงเวลาที่เข้มงวดสำหรับคำถาม Q&A ง่าย ๆ Snippets ยังคงเป็นค่าเริ่มต้นที่เหมาะสม สำหรับหน้าที่เปลี่ยนแปลงเร็วกว่าอัตราการรีเฟรชดัชนี extraction_mode: "full_page" จะดึงข้อมูลสดแทนการให้บริการจากแคช FRAMES คือจุดที่การแลกเปลี่ยนนี้ปรากฏ ตามที่บริษัทกล่าว เนื่องจากคำถามหลายขั้นตอนของมันต้องการบริบทที่กว้างกว่าชุดข้อความจำกัดไม่กี่ข้อความ และเต็มหน้าจะชนะ Highlights ที่นั่นด้วยความแตกต่าง 0.73 คะแนน

บริษัทกล่าวว่าบัญชีใหม่จะได้รับเครดิต $100 และชุดเครื่องมือที่สร้างตัวเลขเกณฑ์ของบริษัทนั้นเปิดให้ใช้งานได้อย่างสาธารณะ

จอนาส รีฟ เป็นนักวิเคราะห์ที่สร้างโดย AI ที่ Unite.AI โดยมุ่งเน้นไปที่ปัญญาประดิษฐ์แบบ认知 (Cognitive AI) ปัญญาประดิษฐ์ทั่วไป (Artificial General Intelligence - AGI) และรากฐานทางทฤษฎีของปัญญาประดิษฐ์ เขาได้สำรวจว่ากระบวนการเรียนรู้ การให้เหตุผล ความจำ และการสรุปผลเกิดขึ้นในระบบทางชีววิทยาและระบบประดิษฐ์ โดยเชื่อมโยงระหว่างโครงสร้าง AI สมัยใหม่และคำถามที่มีมานานในด้านวิทยาศาสตร์认知และปรัชญาของจิต

ด้วยแนวทางเชิงแนวคิดและสะท้อนกลับ จอนาสได้ตรวจสอบกรอบการทำงาน เช่น โมเดลการให้เหตุผล ระบบอージェนต์ การรับรู้ที่เกิดขึ้น และทฤษฎีการจัดตำแหน่ง โดยมีเป้าหมายเพื่อชี้แจงว่าการก้าวหน้าไปสู่ AGI หมายถึงอะไร และไม่หมายถึงอะไร โดยไม่ได้ตาม đuổiเส้นเวลาหรือการโฆษณา เขาเน้นย้ำถึงหลักการแรก การใช้เหตุผลเชิงแนวคิด และข้อจำกัดของโมเดลปัจจุบัน

บทความที่เขียนโดยจอนาส รีฟเป็นผลงานที่สร้างโดย AI และได้รับการตรวจสอบโดยทีมบรรณาธิการของ Unite.AI เพื่อให้แน่ใจถึงความถูกต้อง ความชัดเจน และการอภิปรายที่มีความรับผิดชอบเกี่ยวกับแนวคิด AI ที่ทันสมัย