Yapay zeka modelleri ve platformları
GPT-2, Yapay Zeka Metin Jeneratörü Tamamen Yayınlanıyor
TheNextWeb’in (TNW) raporlarına göre, bir dizi yapay zeka projesinin arkasındaki kâr amacı gütmeyen kuruluş OpenAI, GPT-2 adlı metin jeneratörünün planlanan aşamalı yayınlanmasının son modelini yayınladı. GPT-2, Şubat ayında yayınlanmasının ardından oldukça tartışmalara neden oldu.
OpenAI’nin “Dil Modelleri Gözetimsiz Çoklu Görev Öğrencileridir” adlı araştırma makalesine göre, “GPT-2, sınırlı girdi temelinde yeni metinler oluşturmak için makine öğrenimini kullanır.” Bunun anlamı, bir kullanıcı herhangi bir konu hakkında bir veya iki cümle yazdığında, AI jeneratörü orijinal girdiyle bazı ilişkileri olan bir metin oluşturur. Esasen, TNW’nin not ettiği gibi, çoğu “metin jeneratörü”nden farklı olarak, önceden yazılmış dizeleri çıktılamaktadır. GPT-2, daha önce var olmayan metinler oluşturur.”
Carnegie Mellon Üniversitesi Kütüphaneleri program direktörü Scott B. Weingart, bir tweet’inde somut bir örnek veriyor:
What is a Panther but a young lion?
Bir entire koridor tamamen insanlarla dolu.
How’s this for a happy ending? pic.twitter.com/qvPTrs790N
— Scott B. Weingart (@scott_bot) 20 Ağustos 2019
If death, in some obscure and distant hour,
Strikes me still as I slept, if I yet dream:
Is that my peace with an eternity spent?
[…]
But I fear it will be no peace or rest
Until the stars give me the full glow of their light
To see all my cares and woes in an instant.Shit. pic.twitter.com/QRoi1C3rjj
— Scott B. Weingart (@scott_bot) 20 Ağustos 2019
OpenAI, sistemlerinin olası kötüye kullanımından endişe duyarak, Şubat 2019’da GPT-2’yi sekiz ayda dört parçada yayınlamaya karar verdi. Bloglarında açıkladıkları gibi, “Teknolojinin kötüye kullanımına ilişkin endişelerimiz nedeniyle eğitilmiş modeli yayınlamıyoruz. Sorumlu açıklama deneyimi olarak, araştırmacıların denemeleri için çok daha küçük bir modeli ve bir teknik makaleyi yayınlıyoruz.”
Açıklamalarına göre, tam model 1,5 milyar parametre içeriyor. “Bir model ne kadar çok parametreyle eğitilirse, o kadar ‘zeki’ görünür – insanlar gibi, uygulama mükemmelleştirir.”
TNW’ye göre, OpenAI ilk olarak 124 milyon parametreli bir model yayınladı, daha sonra 355 ve 774 milyon parametreli modelleri yayınladı. Onlara göre, yayımlanan modelleri test ettikten sonra, “her iterasyonun önceki iterasyonlardan önemli bir yetenek artışı gösterdiği” görüldü.
Kötüye kullanımın önüne geçmek için OpenAI, GPT-2’yi “kötüye kullanımıyla mücadele etmek için” önceden önleme amaçlı dedektör modelleri yayınladı. Bir blog yazısında kendi itirafına göre, bu dedektör modelleri hala GPT-2’de şimdiye kadar elde edilen kalite seviyesine ulaşmak için ek çalışmaya ihtiyaç duyuyor.
İlgilenenler GPT-2 modelini burada Github’da indirebilir, model kartını burada inceleyebilir ve OpenAI’nin blog yazısını burada okuyabilir.












