โมเดลและแพลตฟอร์ม AI

Kumo เปิดตัว KumoRFM-2 โมเดลพื้นฐานที่ออกแบบมาเพื่อแทนที่การเรียนรู้ของเครื่องจักรแบบดั้งเดิมสำหรับองค์กร

mm
เพิ่ม Unite.AI ลงในแหล่งข้อมูลที่คุณต้องการบน Google

Kumo ได้เปิดตัว KumoRFM-2 โมเดลพื้นฐานรุ่นต่อไปที่ออกแบบมาโดยเฉพาะสำหรับข้อมูลองค์กรแบบโครงสร้าง—เป็นการเปลี่ยนแปลงพื้นฐานใน cáchที่องค์กรสร้างการคาดการณ์จากคลังข้อมูลของตน ไม่เหมือนกับพายพินัยกรรมการเรียนรู้ของเครื่องจักรแบบดั้งเดิมที่ต้องการเวลาหลายเดือนในการสร้างคุณลักษณะและการพัฒนาแบบจำลอง KumoRFM-2 ช่วยให้ทีมสามารถสร้างการคาดการณ์ได้ทันทีโดยใช้ภาษา自然โดยไม่ต้องฝึกอบรมหรือความเชี่ยวชาญพิเศษ

ที่แก่นกลาง โมเดลนี้แสดงถึงประเภทใหม่ของ AI: โมเดลพื้นฐานเชิงสัมพันธ์ที่ทำงานโดยตรงกับโครงสร้างข้อมูลองค์กรแทนการทำให้ข้อมูลเหล่านั้นกลายเป็นตารางที่เรียบง่าย การแบ่งแยกนี้ giải quyếtข้อจำกัดที่คงอยู่ใน AI องค์กร โดยที่ความสัมพันธ์ที่มีคุณค่าระหว่างชุดข้อมูลมักจะสูญเสียไปก่อนที่การสร้างแบบจำลองจะเริ่มต้น

จากพายพินัยกรรมแบบคงที่ไปสู่ระบบการคาดการณ์แบบเรียลไทม์

การวิเคราะห์เชิงพยากรณ์สำหรับองค์กร มักจะช้าและต้องการทรัพยากรมาก การใช้งานใหม่ๆ —ไม่ว่าจะเป็นการคาดการณ์การยกเลิก การตรวจจับการฉ้อโกง หรือการคาดการณ์อุปสงค์—มักต้องการพายพินัยกรรมที่แยกจากกัน ซึ่งเกี่ยวข้องกับการทำความสะอาดข้อมูล การสร้างคุณลักษณะ การฝึกอบรมแบบจำลอง และการปรับแต่ง

KumoRFM-2 แทนที่กระบวนการทั้งหมดนี้ด้วยระบบที่ฝึกอบรมไว้ล่วงหน้าเพียงครั้งเดียว

แทนการสร้างแบบจำลอง ผู้ใช้สามารถกำหนดสิ่งที่ต้องการคาดการณ์ได้ โมเดลจะทำความเข้าใจคำขอ สร้างบริบทที่จำเป็นจากฐานข้อมูลที่อยู่ภายใต้ และสร้างการคาดการณ์ในครั้งเดียว สิ่งนี้เป็นไปได้โดยผสมผสานการเรียนรู้ในบริบทและการใช้ภาษาเชิงวินิจฉัยที่เรียกว่า Predictive Query Language (PQL) โดยที่ผู้ใช้แสดงผลลัพธ์ที่ต้องการมากกว่าขั้นตอนที่จำเป็นในการคำนวณ

ผลลัพธ์คือการเปลี่ยนแปลงจาก “การสร้างแบบจำลอง” ไปเป็น “การถามคำถาม” —การเปลี่ยนแปลงที่ลดความยากในการใช้ AI เชิงพยากรณ์ทั่วทั้งองค์กร

ทำไมข้อมูลเชิงสัมพันธ์จึงยาก

ระบบ AI ส่วนใหญ่มีปัญหากับข้อมูลองค์กรแบบโครงสร้างเนื่องจากเหตุผลง่ายๆ: พวกมันรักษาข้อมูลนั้นไม่ถูกต้อง

แบบจำลองดั้งเดิม รวมถึงระบบ AI แบบตารางและแบบจำลองภาษาที่ใหญ่ๆ อาศัยการทำให้ข้อมูลกลายเป็นตารางเดียว แต่ข้อมูลองค์กรในโลกแห่งความเป็นจริงมีอยู่ในรูปแบบของระบบที่เชื่อมโยงกัน—ลูกค้าที่เชื่อมโยงกับการทำธุรกรรม การทำธุรกรรมที่เชื่อมโยงกับสินค้า สินค้าที่เชื่อมโยงกับคลังสินค้า ทั้งหมดนี้เปลี่ยนแปลงไปตามเวลา

การทำให้ข้อมูลเหล่านั้นกลายเป็นตารางจะลบความสัมพันธ์ที่มีคุณค่าซึ่งมักจะบรรจุเครื่องหมายการคาดการณ์ที่มีค่าที่สุด นอกจากนี้ยังบังคับให้ทีมต้องสร้างสัญญาณเหล่านั้นขึ้นมาใหม่ผ่านการสร้างคุณลักษณะ ซึ่งเป็นกระบวนการที่ใช้เวลาและเสี่ยงต่อข้อผิดพลาด

KumoRFM-2 หลีกเลี่ยงสิ่งนี้โดยการทำงานโดยตรงกับฐานข้อมูลเชิงสัมพันธ์ โดยเก็บรักษาความเชื่อมโยงระหว่างตาราง ไทม์สตамп และเอนทิตี้

ภายในสถาปัตยกรรม: วิธีการทำงานของ KumoRFM-2

นวัตกรรมหลักที่อยู่เบื้องหลัง KumoRFM-2 คือสถาปัตยกรรม Relational Graph Transformer ซึ่งประมวลผลข้อมูลที่หลายระดับพร้อมกัน

ในระดับแรก โมเดลวิเคราะห์ตารางเดี่ยวโดยใช้การผสมผสานระหว่างการให้ความสนใจแบบแถวและคอลัมน์ สิ่งนี้ช่วยให้เข้าใจว่าคุณลักษณะเหล่านั้นเกี่ยวข้องกันภายในตารางอย่างไร ในขณะที่การกรองข้อมูลที่ไม่เกี่ยวข้องหรือเสียงรบกวนออกไปในต้นกระบวนการ นอกจากนี้ เป้าหมายการคาดการณ์จะถูกนำเข้ามาในขั้นตอนนี้ ซึ่งหมายความว่าโมเดลถูกปรับให้เหมาะสมกับงานตั้งแต่ต้น

ในระดับที่สอง โมเดลทำการให้เหตุผลแบบกราฟข้ามตาราง โดยใช้ความสัมพันธ์ของคีย์ต่างประเทศในการเชื่อมโยงข้อมูลจากส่วนต่างๆ ของฐานข้อมูล—เช่น การเชื่อมโยงโปรไฟล์ลูกค้ากับประวัติการซื้อหรือรูปแบบพฤติกรรม—และระบุสัญญาณข้ามตารางที่จะสูญเสียไป

ในระดับที่สาม โมเดลรวมการให้ความสนใจแบบตัวอย่างข้าม ซึ่งช่วยให้สามารถเรียนรู้จากตัวอย่างหลายตัวอย่างในครั้งเดียว สิ่งนี้ช่วยให้สามารถสรุปผลจากตัวอย่างบริบทที่ค่อนข้างน้อย แทนที่จะจำเป็นต้องใช้ชุดข้อมูลการฝึกอบรมที่สมบูรณ์

การออกแบบที่มีหลายขั้นนี้มีความสำคัญ มันหลีกเลี่ยงการระเบิดเชิงคำนวณที่จะเกิดขึ้นจากการประมวลผลจุดข้อมูลทั้งหมดพร้อมกัน ในขณะเดียวกันก็ปรับปรุงความแม่นยำโดยการกรองเสียงรบกวนออกไปก่อนที่จะเกิดการให้เหตุผลที่ลึกซึ้งยิ่งขึ้น

การเรียนรู้ในบริบทแทนที่การฝึกอบรม

คุณลักษณะที่กำหนดของ KumoRFM-2 คือการอาศัยการเรียนรู้ในบริบทแทนการฝึกอบรมแบบดั้งเดิม

แทนที่จะฝึกอบรมแบบจำลองสำหรับแต่ละงาน KumoRFM-2 ได้รับการฝึกอบรมล่วงหน้าเพียงครั้งเดียวบนชุดข้อมูลสังเคราะห์และข้อมูลโลกแห่งความเป็นจริงที่ผสมผสานกัน เมื่อผู้ใช้ส่งคำขอการคาดการณ์ ระบบจะสร้างชุดตัวอย่างบริบทอัตโนมัติ—ซับกราฟขนาดเล็กของฐานข้อมูลที่จับคู่กับผลลัพธ์ที่ทราบ

ตัวอย่างเหล่านี้ทำหน้าที่เป็นคำแนะนำสำหรับโมเดล ช่วยให้สามารถอนุมานรูปแบบและสร้างการคาดการณ์โดยไม่ต้องอัปเดตความถูกต้อง ในทางปฏิบัติ สิ่งนี้หมายถึง:

  • ไม่ต้องฝึกอบรมสำหรับงานเฉพาะ
  • ไม่ต้องสร้างคุณลักษณะ
  • ไม่ต้องปรับแต่งแบบจำลอง

แม้จะมีข้อมูลเพียง 0.2% ของข้อมูลที่ต้องการสำหรับการเรียนรู้แบบมีคำแนะนำ โมเดลก็สามารถบรรลุประสิทธิภาพระดับแนวหน้าได้

ประสิทธิภาพทั่วมาตรฐานโลกแห่งความเป็นจริง

KumoRFM-2 ได้รับการประเมินบน 41 งานคาดการณ์ที่ครอบคลุมอุตสาหกรรมต่างๆ เช่น อีคอมเมิร์ซ สุขภาพ แพลตฟอร์มสังคม และระบบองค์กร

โมเดลนี้มีประสิทธิภาพเหนือกว่าแนวทางการเรียนรู้ของเครื่องจักรแบบดั้งเดิม รวมถึงระบบการเรียนรู้เชิงสัมพันธ์และแบบจำลองภาษาที่ใหญ่ๆ บนมาตรฐานองค์กร มันเกินผลลัพธ์ของโซลูชันที่ใช้กันอย่างแพร่หลายด้วยระยะห่างที่สำคัญ ในขณะที่ยังคงปรับปรุงต่อไปเมื่อปรับให้เหมาะสม

นอกเหนือจากความแม่นยำโดยรวมแล้ว โมเดลยังแสดงให้เห็นถึงความแข็งแกร่ง:

  • รักษาความสามารถในการทำงานแม้เมื่อเชื่อมโยงเชิงสัมพันธ์หลายส่วนหายไป
  • จัดการข้อมูลที่มีเสียงรบกวนหรือไม่สมบูรณ์ได้ด้วยการเสื่อมสภาพที่น้อยที่สุด
  • ทำงานได้ดีในสถานการณ์การเริ่มต้นใหม่โดยที่ข้อมูลประวัติมีจำกัด

ความทนทานนี้มีความสำคัญอย่างยิ่งในสภาพแวดล้อมองค์กร โดยที่คุณภาพข้อมูลมักจะไม่สอดคล้องกัน

สร้างขึ้นสำหรับการปรับขนาด: สูงถึง 500 พันล้านแถว

KumoRFM-2 ได้รับการออกแบบให้ทำงานที่ระดับของโครงสร้างข้อมูลสมัยใหม่

ระบบสามารถประมวลผลชุดข้อมูลที่เกิน 500 พันล้านแถวโดยการผสมผสานการดำเนินการฐานข้อมูลแบบเนทีฟกับเครื่องยนต์กราฟแบบกำหนดเองที่สามารถเข้าถึงข้อมูลได้ด้วยความเร็วสูง แทนที่จะย้ายข้อมูลเข้าสู่ระบบ ML ที่แยกจากกัน การคำนวณจะถูกผลักดันโดยตรงไปยังที่ที่ข้อมูลอาศัยอยู่—ไม่ว่าจะอยู่ในฐานข้อมูล SQL หรือคลังข้อมูลบนคลาวด์

แนวทางนี้ลดความหน่วง การทำให้การปรับใช้ง่ายขึ้น และช่วยให้องค์กรสามารถรวมความสามารถในการคาดการณ์เข้ากับกระบวนการทำงานที่มีอยู่ได้

ภาษา自然เป็นอินเทอร์เฟซ

คุณลักษณะที่กำหนดอีกอย่างหนึ่งคืออินเทอร์เฟซภาษา自然ของโมเดล

ผู้ใช้สามารถถามคำถามเช่น:

  • ลูกค้าคนไหนที่มีแนวโน้มจะยกเลิกภายใน 30 วันข้างหน้า?
  • ลูกค้าคนไหนที่มีแนวโน้มจะเปลี่ยนเป็นลูกค้าจริง?
  • สินค้าใดที่จะเห็นอุปสงค์เพิ่มขึ้น?

ระบบจะแปลคำถามเหล่านี้เป็นตรรกะการคาดการณ์ที่มีโครงสร้าง ทำงานบนข้อมูลที่อยู่ภายใต้ และส่งกลับผลการคาดการณ์และคำอธิบาย

สิ่งนี้ไม่เพียงแต่ทำให้การวิเคราะห์เชิงพยากรณ์เข้าถึงได้ง่ายขึ้น แต่ยังช่วยให้สามารถรวมเข้ากับตัวแทน AI โดยที่การคาดการณ์สามารถฝังลงในกระบวนการตัดสินใจอัตโนมัติ

สู่การเรียนรู้ของตัวแทนองค์กร

KumoRFM-2 ได้รับการออกแบบโดยคำนึงถึงตัวแทนในใจ

ความสามารถในการคาดการณ์ของมันสามารถเปิดเผยเป็น “ทักษะ” แบบโมดูลาร์ที่ตัวแทน AI สามารถเรียกใช้ได้เป็นส่วนหนึ่งของกระบวนการทำงานที่ใหญ่ขึ้น สิ่งนี้เปลี่ยนการสร้างแบบจำลองเชิงพยากรณ์ให้เป็นบล็อกการสร้างที่สามารถประกอบกันได้—สิ่งที่สามารถรวมกับการดึงข้อมูล การให้เหตุผล และการดำเนินการในระบบอัตโนมัติ

ในบริบทนี้ โมเดลไม่ใช่แค่เครื่องมือสำหรับนักวิเคราะห์ แต่เป็นชั้นพื้นฐานสำหรับการอัตโนมัติองค์กรรุ่นต่อไป

การเปลี่ยนแปลงบทบาทของวิทยาศาสตร์ข้อมูล

KumoRFM-2 ส่งสัญญาณถึงการเปลี่ยนแปลงที่กว้างขึ้นใน cáchที่องค์กรเข้าใกล้วิทยาศาสตร์ข้อมูล

แทนที่จะสร้างและบำรุงรักษาแบบจำลองหลายสิบแบบสำหรับงานเฉพาะ ทีมสามารถพึ่งพาโมเดลทั่วไปที่ปรับให้เหมาะสมกับปัญหาใหม่ๆ ทันที สิ่งนี้ลดความต้องการความเชี่ยวชาญเฉพาะด้านในการสร้างคุณลักษณะและการปรับแต่งแบบจำลอง ในขณะที่ทำให้สามารถทดลองและวนซ้ำได้เร็วขึ้น

สำหรับหลายองค์กร สิ่งนี้อาจหมายถึงการเปลี่ยนแปลงจากหน้าที่วิทยาศาสตร์ข้อมูลที่มีศูนย์กลางไปสู่แบบจำลองที่กระจายออกไป โดยที่ข้อมูลเชิงลึกเชิงพยากรณ์สามารถเข้าถึงได้ทั่วทั้งหลายภาคส่วน

ประเภทใหม่ของโมเดลพื้นฐาน

ในขณะที่โมเดลพื้นฐานได้เปลี่ยนแปลงโดเมนต่างๆ เช่น ภาษาและวิชั่น ข้อมูลองค์กรแบบโครงสร้างยังคงเป็นหนึ่งในพรมแดนสุดท้าย

KumoRFM-2 เป็นตัวอย่างแรกของสิ่งที่โมเดลพื้นฐานเฉพาะสำหรับข้อมูลแบบโครงสร้างสามารถทำได้ โดยการผสมผสานการให้เหตุผลเชิงสัมพันธ์ การเรียนรู้ในบริบท และการโต้ตอบภาษา自然 มันแนะนำ范式ใหม่สำหรับ AI เชิงพยากรณ์

หากได้รับการยอมรับอย่างกว้างขวาง วิธีการนี้อาจเปลี่ยนแปลงวิธีที่ธุรกิจโต้ตอบกับข้อมูลของตน—เปลี่ยนการวิเคราะห์เชิงพยากรณ์จากกระบวนการที่ซับซ้อนและล่าช้าเป็นความสามารถทั่วทั้งองค์กรแบบเรียลไทม์

อองตวนเป็นผู้นำที่มีวิสัยทัศน์และเป็นหุ้นส่วนผู้ก่อตั้งของ Unite.AI โดยมีความหลงใหลที่ไม่สั่นคลอนในการ塑造และ推廣อนาคตของ AI และหุ่นยนต์ เขาเป็นผู้ประกอบการซีรีย์ที่เชื่อว่า AI จะมีผลกระทบต่อสังคมมากเท่ากับไฟฟ้า และมักจะพูดถึงศักยภาพของเทคโนโลยีที่เป็นนวัตกรรมและ AGI

ในฐานะ นักอนาคต เขาได้ทำการสำรวจว่านวัตกรรมเหล่านี้จะเปลี่ยนแปลงโลกของเราอย่างไร นอกจากนี้เขายังเป็นผู้ก่อตั้ง Securities.io ซึ่งเป็นแพลตฟอร์มที่มุ่งเน้นในการลงทุนในเทคโนโลยีที่ทันสมัยที่สุดซึ่งกำลังเปลี่ยนแปลงอนาคตและเปลี่ยนแปลงอุตสาหกรรมทั้งหมด