ผู้นำทางความคิด
การคิดใหม่เกี่ยวกับโอเพ่นซอร์สในยุค AI ที่สร้างสรรค์

โมเดลโอเพ่นซอร์ส – จิตวิญญาณในการพัฒนาซอฟต์แวร์ที่ซึ่งโค้ดต้นฉบับถูกเผยแพร่ฟรีสำหรับการกระจายหรือการปรับเปลี่ยน – ได้เป็นตัวเร่งให้เกิดนวัตกรรมมาอย่างยาวนาน อุดมคตินี้เกิดขึ้นในปี 1983 เมื่อ Richard Stallman นักพัฒนาซอฟต์แวร์ รู้สึกไม่พอใจกับลักษณะของเครื่องพิมพ์ที่ปิดซอร์สของเขา
วิสัยทัศน์ของเขากระตุ้นให้เกิดการเคลื่อนไหวซอฟต์แวร์ฟรี ซึ่งสร้างเส้นทางให้กับระบบนิเวศโอเพ่นซอร์สที่ขับเคลื่อนส่วนใหญ่ของอินเทอร์เน็ตและนวัตกรรมซอฟต์แวร์ในปัจจุบัน
แต่นั่นคือเมื่อเกิน 40 ปีที่แล้ว
ปัจจุบัน AI ที่สร้างสรรค์พร้อมกับความท้าทายด้านเทคนิคและจริยธรรมที่เป็นเอกลักษณ์ กำลังเปลี่ยนแปลงความหมายของ “ความเปิดกว้าง” และเรียกร้องให้เรากลับมาทบทวนและปรับเปลี่ยนพาราได้มโอเพ่นซอร์ส – ไม่ใช่เพื่อปล่อยให้มันไป แต่เพื่อปรับให้เหมาะสม
AI และเสรีภาพโอเพ่นซอร์ส
สี่เสรีภาพพื้นฐานของซอฟต์แวร์โอเพ่นซอร์ส – ความสามารถในการ ใช้งาน, ศึกษา, ปรับเปลี่ยน, และกระจาย โค้ดซอฟต์แวร์ใดๆ – มีความขัดแย้งกับลักษณะของ AI ที่สร้างสรรค์หลายด้าน:
- ใช้งาน: โมเดล AI มักต้องการโครงสร้างพื้นฐานและค่าใช้จ่ายในการคำนวณที่สูงมาก ซึ่ง จำกัด การเข้าถึง เนื่องจากข้อจำกัดด้านทรัพยากร
- ศึกษาและปรับเปลี่ยน: โมเดล AI มีความซับซ้อนมาก จึง เข้าใจและเปลี่ยนแปลง โดยไม่ต้องมีการเข้าถึงโค้ดและข้อมูลที่ใช้ในการสร้างโมเดลนั้น
- กระจาย: โมเดล AI หลายรูปแบบ จำกัดการกระจาย โดยการออกแบบ โดยเฉพาะโมเดลที่มีน้ำหนักการฝึกอบรมและชุดข้อมูลที่เป็นของเจ้าของแพลตฟอร์ม
การกัดเซาะของหลักการเหล่านี้ไม่ได้เกิดจากความตั้งใจที่ไม่ดี แต่มาจากความซับซ้อนและค่าใช้จ่ายของระบบ AI ในปัจจุบันจริงๆ ค่าใช้จ่ายในการฝึกอบรมโมเดล AI ที่ทันสมัยได้เพิ่มขึ้นอย่างมากในช่วงไม่กี่ปีที่ผ่านมา – ค่าใช้จ่ายในการฝึกอบรม GPT-4 ของ OpenAI มีรายงานว่าสูงถึง 78 ล้านดอลลาร์, ไม่รวมค่าจ้างพนักงาน โดยมีค่าใช้จ่ายทั้งหมด เกิน 100 ล้านดอลลาร์.
ความซับซ้อนของ “โอเพ่นซอร์ส” AI
โมเดล AI ที่เปิดกว้างอย่างแท้จริงจะต้องมีการเปิดเผยโค้ดต้นฉบับของการอนุมาน โค้ดต้นฉบับของการฝึกอบรม น้ำหนักของโมเดล และข้อมูลการฝึกอบรม อย่างไรก็ตาม โมเดลหลายรูปแบบที่มีฉลากว่าเป็น “โอเพ่น” จะเผยแพร่โค้ดการอนุมานหรือน้ำหนักที่ไม่สมบูรณ์เท่านั้น ในขณะที่บางรูปแบบมีการออกใบอนุญาตที่จำกัดหรือห้ามการใช้เชิงพาณิชย์โดยสิ้นเชิง
การเปิดกว้างที่ไม่ลำเอียงนี้ทำให้เกิดภาพลวงตาของหลักการโอเพ่นซอร์ส ในขณะที่ในทางปฏิบัติแล้วไม่เพียงพอ
พิจารณาว่าการวิเคราะห์ของ Open Source Initiative (OSI) พบว่าโมเดลภาษาที่มีขนาดใหญ่หลายรูปแบบที่ อ้างว่าเป็นโอเพ่นซอร์ส – รวมทั้ง Llama2 และ Llama 3.x (พัฒนาโดย Meta), Grok (X), Phi-2 (Microsoft) และ Mixtral (Mistral AI) – ไม่สอดคล้องกับหลักการโอเพ่นซอร์ส
ความท้าทายด้านความยั่งยืนและแรงจูงใจ
ซอฟต์แวร์โอเพ่นซอร์สส่วนใหญ่ถูกสร้างขึ้นจากความพยายามของอาสาสมัครหรือเงินทุนสนับสนุน ไม่ใช่โครงสร้างพื้นฐานที่มีค่าใช้จ่ายสูงและต้องการการคำนวณที่เข้มข้น โมเดล AI มีค่าใช้จ่ายสูงในการฝึกอบรมและบำรุงรักษา และค่าใช้จ่ายเหล่านี้คาดว่าจะเพิ่มขึ้นในอนาคต CEO ของ Anthropic, Dario Amodei, คาดการณ์ว่าอาจมีค่าใช้จ่ายสูงถึง $100 พันล้านดอลลาร์ เพื่อฝึกอบรมโมเดล AI ที่ทันสมัย
หากไม่มีแบบจำลองการเงินที่ยั่งยืนหรือโครงสร้างแรงจูงใจ นักพัฒนาต้องเลือกระหว่างการจำกัดการเข้าถึงผ่านโค้ดปิดหรือใบอนุญาตที่ไม่ใช้เชิงพาณิชย์ หรือเสี่ยงต่อการล้มละลายทางการเงิน
ความเข้าใจผิดเกี่ยวกับ “น้ำหนักเปิด” และใบอนุญาต
การเข้าถึงโมเดล AI ได้กลายเป็นเรื่องที่ซับซ้อนมากขึ้น โดยมีหลายแพลตฟอร์มที่ทำการตลาดตัวเองว่าเป็น “โอเพ่น” ในขณะที่มีการจำกัดที่ขัดแย้งกับหลักการโอเพ่นซอร์สที่แท้จริง การ “หลอกลวง” นี้แสดงออกมาในหลายรูปแบบ:
- โมเดลที่มีฉลากว่าเป็น “น้ำหนักเปิด” อาจห้ามการใช้เชิงพาณิชย์โดยสิ้นเชิง ทำให้พวกมันกลายเป็นเรื่องของความสนใจทางวิชาการมากกว่าเครื่องมือทางธุรกิจที่ใช้งานได้จริงสำหรับสาธารณชน
- บางผู้ให้บริการเสนอการเข้าถึงโมเดลที่ฝึกอบรมแล้ว แต่ปกปิดข้อมูลการฝึกอบรมและวิธีการของตน ทำให้ไม่สามารถทำซ้ำหรือตรวจสอบผลการวิจัยได้อย่างมีความหมาย
- หลายแพลตฟอร์มมีการจำกัดการกระจายที่ป้องกันไม่ให้นักพัฒนาสามารถสร้างหรือปรับปรุงโมเดลสำหรับชุมชนของตนเอง แม้ว่าจะสามารถเข้าถึงโค้ดได้เต็มที่
ในกรณีเหล่านี้ “เปิดสำหรับการวิจัย” เป็นเพียงคำพูดที่ไม่จริงสำหรับ “ปิดสำหรับธุรกิจ” ผลลัพธ์คือการล็อกผู้ใช้ในระบบที่ดูเหมือนเปิดกว้าง แต่เมื่อพยายามขยายหรือพาณิชย์ผลิตภัณฑ์จะพบกับการจำกัดที่สำคัญ
ผลลัพธ์ที่ตามมานี้ไม่เพียงแต่ทำให้นักพัฒนารู้สึกผิดหวังเท่านั้น แต่ยังทำให้ความไว้วางใจในระบบนิเวศ AI ถูกทำลายด้วย มันสร้างความคาดหวังที่ไม่สมจริงในหมู่ผู้มีส่วนได้ส่วนเสียที่คิดว่า “โอเพ่น” AI คล้ายกับชุมชนซอฟต์แวร์โอเพ่นซอร์ส ซึ่งความโปร่งใส่ สิทธิ์ในการปรับเปลี่ยน และเสรีภาพเชิงพาณิชย์ถูกยึดถือ
ความล่าช้าทางกฎหมาย
ความก้าวหน้าอย่างรวดเร็วของ GenAI ได้ทำให้การสร้างกรอบกฎหมายที่เหมาะสมตกอยู่เบื้องหลังแล้ว โดยสร้างเว็บที่ซับซ้อนของความท้าทายด้านทรัพย์สินทางปัญญาที่เพิ่มขึ้นจากความกังวลที่มีอยู่แล้ว
สนามรบทางกฎหมายครั้งแรกมุ่งเน้นไปที่การใช้ข้อมูลการฝึกอบรม โมเดลการเรียนรู้ลึกใช้ชุดข้อมูลขนาดใหญ่จากอินเทอร์เน็ต เช่น รูปภาพและข้อความบนเว็บ การรวบรวมข้อมูลขนาดใหญ่นี้ได้ทำให้เกิดการถกเถียงกันอย่างรุนแรงเกี่ยวกับสิทธิ์ในทรัพย์สินทางปัญญา บริษัทเทคโนโลยีแย้งว่าระบบ AI ของตนศึกษาและเรียนรู้จากสื่อที่มีลิขสิทธิ์เพื่อสร้างเนื้อหาที่เปลี่ยนแปลงใหม่ ผู้ถือลิขสิทธิ์กล่าวว่าบริษัท AI เหล่านี้ลอกเลียนแบบผลงานของตนโดยไม่ได้รับอนุญาต และสร้างเนื้อหาที่แข่งขันกันซึ่งกระทบต่อการดำรงชีวิตของพวกเขา
การเป็นเจ้าของผลงานที่สร้างโดย AI เป็นอีกหนึ่งความไม่แน่นอนที่ยังไม่มีคำตอบ ไม่มีใครแน่ใจว่าจะจัดประเภทเนื้อหาที่สร้างโดย AI ได้อย่างไร นอกจากสำนักงานลิขสิทธิ์สหรัฐฯ ที่ระบุว่า “หาก AI สร้างเนื้อหาทั้งหมด ไม่สามารถได้รับการคุ้มครองลิขสิทธิ์”
ความไม่แน่นอนทางกฎหมายเกี่ยวกับ GenAI – โดยเฉพาะเรื่องการละเมิดลิขสิทธิ์ การเป็นเจ้าของผลงานที่สร้างโดย AI และเนื้อหาที่ไม่ได้รับอนุญาตในการฝึกอบรม – ยังคงซับซ้อนมากขึ้นเมื่อโมเดล AI พื้นฐานเกิดขึ้นเป็นเครื่องมือที่มีความสำคัญทางภูมิรัฐศาสตร์: ประเทศที่แข่งขันกันเพื่อพัฒนาความสามารถ AI ที่เหนือกว่าอาจไม่เต็มใจที่จะจำกัดการเข้าถึงข้อมูล ทำให้ประเทศที่มีการคุ้มครองทรัพย์สินทางปัญญาที่เข้มงวดตกอยู่ในความเสี่ยง
สิ่งที่โอเพ่นซอร์สต้องกลายเป็นในยุค AI
รถไฟ GenAI ได้ออกตัวแล้วและไม่มีแนวโน้มที่จะชะลอตัว เราหวังว่าจะสร้างอนาคตที่ AI ส่งเสริมนวัตกรรมมากกว่าการขัดขวาง ในกรณีนี้ ผู้นำด้านเทคโนโลยีต้องมีกรอบการทำงานที่รับประกันการใช้เชิงพาณิชย์ที่ปลอดภัยและโปร่งใส ส่งเสริมนวัตกรรมที่รับผิดชอบ จัดการกับการเป็นเจ้าของข้อมูลและใบอนุญาต และแยกความแตกต่างระหว่าง “โอเพ่น” และ “ฟรี”
แนวคิดที่เกิดขึ้นใหม่ เช่น ใบอนุญาตโอเพ่นซอร์สเชิงพาณิชย์ อาจเป็นทางออกหนึ่งโดยเสนอการเข้าถึงฟรีสำหรับการใช้ที่ไม่ใช่เชิงพาณิชย์ การเข้าถึงที่ได้รับใบอนุญาตสำหรับการใช้เชิงพาณิชย์ และการยอมรับและเคารพในเรื่องของต้นกำเนิดและความเป็นเจ้าของข้อมูล
เพื่อปรับตัวให้เข้ากับความเป็นจริงใหม่นี้ ชุมชนโอเพ่นซอร์สต้องสร้างโมเดลใบอนุญาตโอเพ่นซอร์สที่เฉพาะเจาะจงสำหรับ AI จัดตั้งความร่วมมือระหว่างภาครัฐและเอกชนเพื่อสนับสนุนโมเดลเหล่านี้ และสร้างมาตรฐานที่เชื่อถือได้สำหรับความโปร่งใส่ ความปลอดภัย และจริยธรรม
โอเพ่นซอร์สเปลี่ยนโลกครั้งหนึ่งแล้ว AI ที่สร้างสรรค์กำลังเปลี่ยนโลกอีกครั้ง เพื่อรักษาเจตนารมณ์ของความเปิดกว้าง เราต้องพัฒนากฎหมายให้เข้ากับความต้องการที่เป็นเอกลักษณ์ของ AI ในขณะเดียวกันก็เผชิญกับความท้าทายเหล่านี้อย่างตรงไปตรงมา เพื่อสร้างระบบนิเวศที่ครอบคลุมและยั่งยืน












