โมเดลและแพลตฟอร์ม AI
GPT-2, ระบบสร้างข้อความด้วยปัญญาประดิษฐ์ถูกปล่อยออกมาอย่างเต็มรูปแบบ
ตามที่ TheNextWeb (TNW) รายงาน OpenAI องค์กรไม่แสวงหาผลกำไรที่อยู่เบื้องหลังโครงการปัญญาประดิษฐ์หลายโครงการได้เผยแพร่โมเดลสุดท้ายในแผนการปล่อย GPT-2 ที่วางแผนไว้แล้ว ซึ่งเป็นเครื่องมือสร้างข้อความที่ทำให้เกิดการถกเถียงกันมากตั้งแต่การประกาศปล่อยออกมาในเดือนกุมภาพันธ์
ตามเอกสารวิจัยของ OpenAI ที่มีชื่อว่า Language Models are Unsupervised Multitask Learners, “GPT-2 ใช้การเรียนรู้ของเครื่องจักรเพื่อสร้างข้อความใหม่ตามข้อมูลที่จำกัด” ซึ่งหมายความว่าผู้ใช้สามารถพิมพ์ประโยคหรือสองประโยคเกี่ยวกับเรื่องใดๆ และเครื่องมือสร้างข้อความจะสร้างข้อความที่มีความเกี่ยวข้องกับข้อมูลที่พิมพ์เข้าไป ใน본质 ตามที่ TNW ระบุว่า ไม่เหมือนกับเครื่องมือสร้างข้อความส่วนใหญ่ GPT-2 ไม่ได้แสดงข้อความที่ถูกเขียนไว้ล่วงหน้า GPT-2 สร้างข้อความที่ไม่มีอยู่มาก่อน”
ในツイッターของเขา Scott B. Weingart ผู้อำนวยการโปรแกรมของห้องสมุดมหาวิทยาลัยคาร์เนกีเมลลอนให้例ที่具体:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20 สิงหาคม 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20 สิงหาคม 2019
OpenAI ตั้งใจว่าจะปล่อย GPT-2 ออกมาอย่างเต็มรูปแบบในเดือนกุมภาพันธ์ 2019 แต่เนื่องจากความกังวลเกี่ยวกับการใช้งานที่อาจเป็นอันตราย จึงตัดสินใจปล่อยออกมาเป็น 4 ส่วนในระยะเวลา 8 เดือน ตามที่พวกเขาอธิบายไว้ในบล็อกของพวกเขา “เนื่องจากความกังวลเกี่ยวกับการใช้งานที่อาจเป็นอันตรายของเทคโนโลยีนี้ เราจึงไม่ได้ปล่อยโมเดลที่ถูกฝึกไว้ ในฐานะการทดลองในการเปิดเผยอย่างรับผิดชอบ เราได้ปล่อยโมเดลที่เล็กกว่าสำหรับนักวิจัยทดลอง และได้เผยแพร่เอกสารทางเทคนิค”
ตามที่อธิบายไว้ โมเดลที่สมบูรณ์ประกอบด้วยพารามิเตอร์ 1.5 พันล้าน “จำนวนพารามิเตอร์ที่โมเดลถูกฝึกมาคือสิ่งที่ทำให้มันดู ‘ฉลาด’ ขึ้น – เช่นเดียวกับมนุษย์ การฝึกฝนทำให้สมบูรณ์แบบ”
TNW ระบุว่าในตอนแรก OpenAI ปล่อยโมเดลที่มีพารามิเตอร์ 124 ล้านตัว และต่อมาได้ปล่อยโมเดลที่มีพารามิเตอร์ 355 และ 774 ล้านตัว ตามที่พวกเขาระบุไว้ หลังจากทดสอบโมเดลที่ปล่อยออกมา “ทุกๆ การปล่อยออกมาแสดงให้เห็นถึงการปรับปรุงความสามารถมากกว่าการปล่อยครั้งก่อน”
เพื่อป้องกันการใช้งานที่ไม่เหมาะสม OpenAI ปล่อยโมเดลการตรวจจับ GPT-2 ซึ่งถูกออกแบบมาเพื่อ “ป้องกันการใช้งานที่ไม่เหมาะสม” ตามที่พวกเขารับทราบใน โพสต์บล็อก โมเดลการตรวจจับนี้ยังคงต้องการการทำงานเพิ่มเติมเพื่อให้ถึงระดับคุณภาพที่ได้รับใน GPT-2
ผู้ที่สนใจสามารถ ดาวน์โหลดโมเดล GPT-2 ที่นี่ ใน Github ตรวจสอบการ์ดโมเดล ที่นี่ และอ่านโพสต์บล็อกของ OpenAI ที่นี่












