نماذج ومنصات الذكاء الاصطناعي
GPT-2، جهاز توليد النصوص الذكي يُطرح بالكامل
كما تقارير TheNextWeb (TNW)، OpenAI، المنظمة غير الهادفة للربح خلف العديد من مشاريع الذكاء الاصطناعي، نشرت النموذج النهائي في الإصدار المتدرج المخطط لـ GPT-2، جهاز توليد النصوص الذي أثار الكثير من الجدل منذ إعلان إطلاقه في فبراير.
استنادًا إلى ورقة بحثية لشركة OpenAI بعنوان النماذج اللغوية هي متعلمو المهام المتعددة غير الموجهة، يستخدم GPT-2 التعلم الآلي لتوليد نصوص جديدة بناءً على مدخلات محدودة.” ما يعني ذلك هو أن المستخدم يمكن كتابة جملة أو جملتين حول أي موضوع، وسيتولى جهاز التوليد النصوص توليد نص له بعض العلاقة بالمدخلات الأصلية. في جوهره، كما يشير TNW، على عكس معظم “أجهزة توليد النصوص”، لا يخرج نصًا مسبقًا.
في تغريدته، يقدم سكوت ب. وينغارت، مدير برنامج مكتبات جامعة كارنيجي ميلون، مثالًا ملموسًا:
What is a Panther but a young lion?
An entire corridor filled entirely with people screaming.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20 أغسطس 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20 أغسطس 2019
كانت OpenAI قلقة في البداية بشأن الاستخدامات المحتملة الخبيثة لنظامها، لذلك قررت في فبراير 2019 إطلاق GPT-2 في أربعة أجزاء على مدار ثمانية أشهر. كما أشاروا في مدونتهم، “نظرًا لقلقنا بشأن التطبيقات الخبيثة للتكنولوجيا، نحن لا نطلق النموذج المُدرّب. كتجربة في الكشف المسؤول، نحن بدلاً من ذلك نطلق نموذجًا أصغر بكثير للباحثين لتجربته، بالإضافة إلى ورقة تقنية.”
كما أشاروا، يحتوي النموذج الكامل على 1.5 مليار معامل. “كلما زادت المعاملات التي يتم تدريب النموذج عليها، زادت ذكاءً – مثل البشر، الممارسة تجعل الكمال.”
يشير TNW إلى أن OpenAI أطلقت في البداية نموذجًا يحتوي على 124 مليون معامل، تلاه إطلاق نموذج يحتوي على 355 مليون معامل، ثم 774 مليون معامل. وفقًا لهم، بعد اختبار النماذج المُطلقة، “أظهر كل تكرار تحسنًا كبيرًا في القدرة على التكرار السابق.”
为了 منع سوء الاستخدام، أطلقت OpenAI نماذج كشف GPT-2 التي من المفترض أن “تسبق الاستخدام الخبيث.” وفقًا لاعترافهم في مدونة، هذه نماذج الكشف لا تزال بحاجة إلى عمل إضافي للوصول إلى مستوى الجودة الذي تم تحقيقه حتى الآن في GPT-2 نفسه.
يمكن للمهتمين تحميل نموذج GPT-2 هنا على Github، واستعراض بطاقة النموذج هنا، وقراءة مدونة OpenAI هنا.












