โมเดลและแพลตฟอร์ม AI
เชื่อมต่อโมเดลภาษาขนาดใหญ่และธุรกิจ: LLMops
พื้นฐานของ LLMs เช่น GPT-3 ของ OpenAI หรือ GPT-4 ที่ตามมาอยู่ในด้านการเรียนรู้เชิงลึก ซึ่งเป็นส่วนหนึ่งของ AI ที่ใช้เครือข่ายประสาทเทียมที่มีสามชั้นหรือมากกว่า โมเดลเหล่านี้ได้รับการฝึกอบรมจากชุดข้อมูลขนาดใหญ่ที่ครอบคลุมสเปกตรัมของข้อความบนอินเทอร์เน็ตอย่างกว้างขวาง ผ่านการฝึกอบรม LLMs จะเรียนรู้ที่จะคาดการณ์คำถัดไปในลำดับ โดยพิจารณาจากคำที่มาก่อนหน้านี้ ความสามารถนี้ซึ่งดูเหมือนง่ายในเนื้อหาเป็นพื้นฐานของความสามารถของ LLMs ในการสร้างข้อความที่สอดคล้องกันและเกี่ยวข้องในบริบทเป็นระยะเวลานาน
การประยุกต์ใช้เหล่านี้ไม่มีขอบเขต – ตั้งแต่การเขียนอีเมล การสร้างโค้ด การตอบคำถาม ไปจนถึงการเขียนสร้างสรรค์ อย่างไรก็ตาม ด้วยอำนาจที่ยิ่งใหญ่ มีความรับผิดชอบที่ยิ่งใหญ่ด้วย และการจัดการโมเดลเหล่านี้ใน环境การผลิตไม่ใช่เรื่องง่าย นี่คือที่ที่ LLMOps เข้ามา โดยเป็นตัวแทนของชุดแนวทางปฏิบัติที่ดีที่สุด เครื่องมือ และกระบวนการเพื่อให้แน่ใจถึงการทำงานที่เชื่อถือได้ มั่นคง และมีประสิทธิภาพของ LLMs
เส้นทางสู่การรวม LLM มีสามเส้นทางที่โดดเด่น:
- การเรียกใช้ LLM ทั่วไป:
- โมเดล เช่น ChatGPT และ Bard มีระดับการยอมรับที่ต่ำสำหรับการนำไปใช้ โดยมีค่าใช้จ่ายเริ่มต้นน้อยที่สุด แต่อาจมีราคาที่สูงกว่าในระยะยาว
- อย่างไรก็ตาม มีเงาแห่งความเป็นส่วนตัวของข้อมูลและความปลอดภัยที่มีอยู่ โดยเฉพาะอย่างยิ่งสำหรับภาคส่วน เช่น Fintech และ Healthcare ที่มีกรอบการกำกับดูแลที่เข้มงวด
- การปรับแต่ง LLM ทั่วไป:
- ด้วยโมเดลโอเพ่นซอร์ส เช่น Llama, Falcon และ Mistral องค์กรสามารถปรับโมเดลเหล่านี้ให้สอดคล้องกับกรณีการใช้งานเฉพาะของตน โดยใช้ทรัพยากรในการปรับแต่งโมเดลเท่านั้น
- เส้นทางนี้ในขณะที่แก้ไขข้อกังวลเรื่องความเป็นส่วนตัวและความปลอดภัย ต้องการการคัดเลือกโมเดล การเตรียมข้อมูล การปรับแต่ง การใช้งาน และการตรวจสอบที่ลึกซึ้งยิ่งขึ้น
- ลักษณะการวนซ้ำของเส้นทางนี้ต้องการการมีส่วนร่วมอย่างต่อเนื่อง แต่นวัตกรรมล่าสุด เช่น LoRA (Low-Rank Adaptation) และ Q(Quantized)-LoRa ได้ทำให้กระบวนการปรับแต่งง่ายขึ้น ทำให้เป็นตัวเลือกที่ได้รับความนิยมมากขึ้น
- การฝึกอบรม LLM ที่กำหนดเอง:
- การสร้าง LLM จากศูนย์ให้ความแม่นยำที่ไม่มีใครเทียบได้ซึ่งปรับให้เหมาะกับงานที่ทำ อย่างไรก็ตาม ความต้องการที่สูงในด้านความเชี่ยวชาญด้าน AI ทรัพยากรการคำนวณ ข้อมูลที่กว้างขวาง และการลงทุนด้านเวลา ทำให้เกิดอุปสรรคที่สำคัญ
ในบรรดาสามตัวเลือกนี้ การปรับแต่ง LLM ทั่วไปเป็นตัวเลือกที่น่าสนใจที่สุดสำหรับบริษัทต่างๆ การสร้างโมเดลใหม่จากศูนย์อาจมีค่าใช้จ่ายสูงถึง 100 ล้านดอลลาร์ ในขณะที่การปรับแต่งโมเดลที่มีอยู่แล้วมีค่าใช้จ่ายระหว่าง 100,000 ถึง 1 ล้านดอลลาร์ ตัวเลขเหล่านี้มาจากค่าใช้จ่ายในการคำนวณ การได้มาซึ่งข้อมูลและการทำฉลาก รวมถึงค่าใช้จ่ายด้านวิศวกรรมและการวิจัยและพัฒนา
LLMOps เทียบกับ MLOps
การดำเนินงานของโมเดลการเรียนรู้ของเครื่อง (MLOps) ได้รับการพัฒนาอย่างดี โดยให้เส้นทางที่มีโครงสร้างในการเปลี่ยนโมเดลการเรียนรู้ของเครื่อง (ML) จากการพัฒนาไปสู่การผลิต อย่างไรก็ตาม ด้วยการเพิ่มขึ้นของโมเดลภาษาขนาดใหญ่ (LLMs) วิธีการดำเนินงานใหม่ที่เรียกว่า LLMOps ได้ปรากฏขึ้นเพื่อจัดการกับความท้าทายที่ไม่เหมือนใครที่เกี่ยวข้องกับการใช้งานและการจัดการ LLMs ความแตกต่างระหว่าง LLMOps และ MLOps อยู่ที่ปัจจัยหลายประการ:
- ทรัพยากรการคำนวณ:
- LLMs ต้องการความสามารถในการคำนวณที่สำคัญสำหรับการฝึกอบรมและการปรับแต่ง ซึ่งมักต้องการฮาร์ดแวร์เฉพาะ เช่น GPU เพื่อเร่งการดำเนินการขนานข้อมูล
- cobertura ของการอนุมานเพิ่มเติมเน้นย้ำถึงความสำคัญของเทคนิคการบีบอัดและกลั่นกรองแบบจำลองเพื่อควบคุมค่าใช้จ่ายในการคำนวณ
- การเรียนรู้แบบถ่ายทอด:
- ไม่เหมือนกับโมเดล ML ทั่วไปที่มักจะถูกฝึกอบรมจากศูนย์ LLMs พึ่งพาการเรียนรู้แบบถ่ายทอดอย่างมาก โดยเริ่มต้นจากโมเดลที่ได้รับการฝึกอบรมล่วงหน้าและปรับแต่งสำหรับงานเฉพาะ
- แนวทางนี้ช่วยประหยัดข้อมูลและทรัพยากรการคำนวณ ในขณะเดียวกันก็บรรลุผลลัพธ์ที่ดีที่สุดในระดับเดียวกัน
- วงจรป้อนกลับของมนุษย์:
- การปรับปรุงแบบเชิงกลของ LLMs ได้รับแรงผลักดันอย่างมากจากกระบวนการเรียนรู้แบบเสริมจากข้อเสนอแนะของมนุษย์ (RLHF)
- การรวมวงจรป้อนกลับเข้ากับกระบวนการ LLMOps ไม่เพียงแต่ทำให้กระบวนการประเมินง่ายขึ้น แต่ยังช่วยให้กระบวนการปรับแต่งโมเดลได้ด้วย
- การปรับพารามิเตอร์ไฮเปอร์:
- ในขณะที่ ML คลาสสิกเน้นการปรับปรุงความแม่นยำผ่านการปรับพารามิเตอร์ไฮเปอร์ ในด้าน LLMs การมุ่งเน้นยังครอบคลุมถึงการลดความต้องการการคำนวณด้วย
- การปรับพารามิเตอร์ เช่น ขนาดแบตช์และอัตราการเรียนรู้ สามารถเปลี่ยนแปลงความเร็วและต้นทุนในการฝึกอบรมได้อย่างเห็นได้ชัด
- เมตริกการแสดงผล:
- โมเดล ML ทั่วไปยึดติดกับเมตริกการแสดงผลที่กำหนดไว้อย่างดี เช่น ความแม่นยำ AUC หรือคะแนน F1 ในขณะที่ LLMs มีชุดเมตริกที่แตกต่าง เช่น BLEU และ ROUGE
- BLEU และ ROUGE เป็นเมตริกที่ใช้ในการประเมินคุณภาพของการแปลและการสรุปของเครื่อง BLEU ใช้สำหรับการแปลอัตโนมัติ ในขณะที่ ROUGE ใช้สำหรับการสรุปข้อความ
- BLEU วัดความแม่นยำ หรือจำนวนคำที่ปรากฏในสรุปผลที่สร้างโดยเครื่องในสรุปอ้างอิงของมนุษย์ ROUGE วัดความเรียกซ้ำ หรือจำนวนคำที่ปรากฏในสรุปอ้างอิงของมนุษย์ที่ปรากฏในสรุปผลที่สร้างโดยเครื่อง
- วิศวกรรมพรอมต์:
- การออกแบบพรอมต์ที่แม่นยำเป็นสิ่งจำเป็นในการรับคำตอบที่แม่นยำและเชื่อถือได้จาก LLMs ซึ่งลดความเสี่ยง เช่น การหลอกลวงของโมเดลและการแฮกพรอมต์
- การก่อสร้าง LLM Pipelines:
- เครื่องมือ เช่น LangChain หรือ LlamaIndex ช่วยให้สามารถสร้าง LLM Pipelines ซึ่งรวมการเรียก LLM หลายครั้งหรือการโต้ตอบกับระบบภายนอกสำหรับงานที่ซับซ้อน เช่น การตอบคำถามฐานความรู้
การทำความเข้าใจกระบวนการ LLMOps: การวิเคราะห์เชิงลึก
Language Model Operations หรือ LLMOps เปรียบเสมือนกระดูกสันหลังของการดำเนินงานของโมเดลภาษาขนาดใหญ่ โดยรับประกันการทำงานที่ราบรื่นและบูรณาการข้ามแอปพลิเคชันต่างๆ ในขณะที่ดูเหมือนเป็นรูปแบบหนึ่งของ MLOps หรือ DevOps LLMOps มีเอกลักษณ์ที่เฉพาะเจาะจงซึ่งตรงตามความต้องการของโมเดลภาษาขนาดใหญ่ มาทำความเข้าใจกระบวนการ LLMOps ที่แสดงในภาพประกอบ โดยสำรวจทุกขั้นตอนอย่างครอบคลุม
- ข้อมูลฝึกอบรม:
- แก่นแท้ของโมเดลภาษาอยู่ที่ข้อมูลฝึกอบรม ขั้นตอนนี้เกี่ยวข้องกับการรวบรวมชุดข้อมูล การรับรองว่าข้อมูลถูกทำความสะอาด มีความสมดุล และมีการทำเครื่องหมายอย่างเหมาะสม คุณภาพและความหลากหลายของข้อมูลส่งผลกระทบอย่างมีนัยสำคัญต่อความแม่นยำและความสามารถของโมเดล ใน LLMOps การเน้นไม่เพียงแต่ปริมาณเท่านั้น แต่ยังรวมถึงการปรับให้เหมาะสมกับการใช้งานที่ตั้งใจไว้ด้วย
- โมเดลพื้นฐานโอเพ่นซอร์ส:
- ภาพประกอบอ้างถึง “โมเดลพื้นฐานโอเพ่นซอร์ส” ซึ่งเป็นโมเดลที่ได้รับการฝึกอบรมล่วงหน้าซึ่งมักจะถูกเผยแพร่โดยหน่วยงาน AI ชั้นนำ โมเดลเหล่านี้ซึ่งได้รับการฝึกอบรมจากชุดข้อมูลขนาดใหญ่ เป็นจุดเริ่มต้นที่ดีเยี่ยม ช่วยประหยัดเวลาและทรัพยากร ทำให้สามารถปรับแต่งสำหรับงานเฉพาะได้แทนการฝึกอบรมใหม่
- การฝึกอบรม/การปรับแต่ง:
- ด้วยโมเดลพื้นฐานและข้อมูลฝึกอบรมเฉพาะ การปรับแต่งเกิดขึ้น ขั้นตอนนี้ทำให้โมเดลมีความเหมาะสมสำหรับวัตถุประสงค์เฉพาะ เช่น การปรับแต่งโมเดลข้อความทั่วไปด้วยวรรณกรรมทางการแพทย์สำหรับการใช้งานด้านการดูแลสุขภาพ ใน LLMOps การปรับแต่งอย่างเข้มงวดพร้อมการตรวจสอบอย่างต่อเนื่องเป็นสิ่งสำคัญเพื่อป้องกันการปรับแต่งมากเกินไปและรับประกันการบูรณาการที่ดีสำหรับข้อมูลที่ไม่เคยเห็นมาก่อน
- โมเดลที่ได้รับการฝึกอบรม:
- หลังการปรับแต่ง โมเดลที่ได้รับการฝึกอบรมและพร้อมสำหรับการใช้งานจะปรากฏขึ้น โมเดลนี้เป็นรุ่นที่ได้รับการปรับปรุงของโมเดลพื้นฐาน ซึ่งตอนนี้ได้รับการปรับให้เหมาะสมสำหรับการใช้งานเฉพาะ มันอาจเป็นโอเพ่นซอร์ส โดยมีน้ำหนักและสถาปัตยกรรมที่สามารถเข้าถึงได้โดยสาธารณะ หรือเป็นของเอกชน ซึ่งถูกเก็บเป็นความลับโดยองค์กร
- การปรับใช้:
- การปรับใช้หมายถึงการรวมโมเดลเข้ากับสภาพแวดล้อมการผลิตสำหรับการประมวลผลคำถามในโลกแห่งความเป็นจริง มันเกี่ยวข้องกับการตัดสินใจเกี่ยวกับการโฮสต์ ไม่ว่าจะเป็นบนพื้นฐานหรือบนแพลตฟอร์มคลาวด์ ใน LLMOps การพิจารณาเรื่องความหน่วง ค่าใช้จ่ายในการคำนวณ และความสามารถในการเข้าถึงเป็นสิ่งสำคัญ พร้อมด้วยการรับรองว่าโมเดลสามารถปรับขนาดได้ดีสำหรับคำร้องขอพร้อมกันหลายรายการ
- พรอมต์:
- ในโมเดลภาษา พรอมต์เป็นคำถามหรือคำสั่งทางเข้า การสร้างพรอมต์ที่มีประสิทธิภาพ ซึ่งมักต้องการความเข้าใจพฤติกรรมของโมเดล เป็นสิ่งจำเป็นในการรับผลลัพธ์ที่ต้องการเมื่อโมเดลประมวลผลพรอมต์เหล่านี้
- การเก็บข้อมูลแบบฝังตัวหรือ ฐานข้อมูลเวกเตอร์:
- หลังการประมวลผล โมเดลอาจส่งกลับมากกว่าคำตอบข้อความธรรมดา แอปพลิเคชันที่ซับซ้อนอาจต้องใช้การฝังตัว – เวกเตอร์สูงมิติที่แสดงถึงเนื้อหาสมมติ เวกเตอร์เหล่านี้สามารถเก็บไว้ในรูปแบบการบริการ ทำให้สามารถดึงหรือเปรียบเทียบข้อมูลเชิงสำนวนได้อย่างรวดเร็ว ทำให้สามารถใช้ประโยชน์จากความสามารถของโมเดลได้อย่างกว้างขวางมากกว่าการสร้างข้อความเพียงอย่างเดียว
- โมเดลที่ได้รับการปรับใช้ (แบบ self-hosted หรือ API):
- เมื่อประมวลผลเสร็จสิ้น ผลลัพธ์ของโมเดลพร้อมแล้ว ขึ้นอยู่กับกลยุทธ์ ผลลัพธ์สามารถเข้าถึงได้ผ่านอินเทอร์เฟซ self-hosted หรือ API โดยที่แบบแรกให้การควบคุมมากกว่าแก่องค์กรโฮสต์ และแบบหลังให้ความสามารถในการปรับขนาดและรวมเข้ากับนักพัฒนาบุคคลที่สามได้ง่าย
- ผลลัพธ์:
- ขั้นตอนนี้ให้ผลลัพธ์ที่เป็นรูปธรรมของกระบวนการทำงาน โมเดลรับพรอมต์ประมวลผล และส่งกลับผลลัพธ์ ซึ่งอาจเป็นบล็อกข้อความ คำตอบ เรื่องราวที่สร้างขึ้น หรือแม้แต่เวกเตอร์ฝังตัวตามที่กล่าวถึง
LLM สตาร์ทอัพชั้นนำ
ภูมิทัศน์ของการดำเนินงานโมเดลภาษาขนาดใหญ่ (LLMOps) ได้เห็นถึงการเกิดขึ้นของแพลตฟอร์มและสตาร์ทอัพเฉพาะด้าน ต่อไปนี้คือสองสตาร์ทอัพ/แพลตฟอร์มและคำอธิบายที่เกี่ยวข้องกับพื้นที่ LLMOps:
Comet สตรีมไลน์วงจรชีวิตของการเรียนรู้ของเครื่อง โดยเฉพาะสำหรับการพัฒนาโมเดลภาษาขนาดใหญ่ มันให้ความสามารถในการติดตามการทดลองและการจัดการโมเดลการผลิต แพลตฟอร์มนี้เหมาะสำหรับทีมองค์กรขนาดใหญ่ โดยมีกลยุทธ์การปรับใช้หลายแบบ รวมถึงการกำหนดค่าเอกชายน์ ไฮบริด และบนพื้นฐาน
Dify
Dify เป็นแพลตฟอร์ม LLMOps แบบโอเพ่นซอร์สที่ช่วยในการพัฒนาแอปพลิเคชัน AI โดยใช้โมเดลภาษาขนาดใหญ่ เช่น GPT-4 มันแสดงอินเทอร์เฟซที่ใช้งานง่าย และให้การเข้าถึงแบบจำลองที่ราบรื่น การฝังตัวแบบจำลอง ควบคุมต้นทุน และความสามารถในการทำเครื่องหมายข้อมูล ผู้ใช้สามารถจัดการโมเดลของตนได้อย่างง่ายดายและใช้เอกสาร เว็บคอนเทนต์ หรือบันทึกย่อ Notion เป็นบริบท AI ซึ่ง Dify จัดการสำหรับการประมวลผลล่วงหน้าและดำเนินการอื่นๆ
Portkey.ai
Portkey.ai เป็นสตาร์ทอัพของอินเดียที่เชี่ยวชาญด้านการดำเนินงานโมเดลภาษา (LLMOps) ด้วยการระดมทุนซีรีส์ซีได้ 3 ล้านเหรียญสหรัฐฯ นำโดย Lightspeed Venture Partners Portkey.ai มีการผสานรวมกับโมเดลภาษาขนาดใหญ่ที่สำคัญ เช่น โมเดลจาก OpenAI และ Anthropic บริการของพวกเขาให้บริการแก่บริษัท AI ที่สร้างสรรค์ โดยมุ่งเน้นในการปรับปรุงการดำเนินงานของ LLM ซึ่งรวมถึงการทดสอบคานารี่แบบเรียลไทม์และความสามารถในการปรับแต่งแบบจำลอง













