Andersonâun AÃ§ÄąsÄą
LLM Veri KaçaklarÄąndan Promt’leri Koruma

GÃķrÞŠIBM NeurIPS 2024âten ilginç bir sunum geçtiÄimiz hafta Arxivâde yeniden ortaya Ã§ÄąktÄą. BÞyÞk Dil Modelleri (LLM) gibi ChatGPT ile sohbet ederken kullanÄącÄąlarÄąn kiÅisel veya hassas bilgileri mesajlara girmekten korumak için mÞdahale edebilecek bir sistem Ãķneriyor.

KullanÄącÄąlarÄąn bir.prompt-mÞdahale hizmetiyle nasÄąl etkileÅime gireceÄini belirlemek için kullanÄąlan bir kullanÄącÄą çalÄąÅmasÄą için oluÅturulan Ãķrnekler. Kaynak: https://arxiv.org/pdf/2502.18509
YukarÄądaki gÃķrseller, IBM araÅtÄąrmacÄąlarÄą tarafÄąndan bu tÞr âmÞdahaleâye karÅÄą olasÄą kullanÄącÄą sÞrtÞnmesini test etmek için kullanÄąlan bir çalÄąÅmada kullanÄąldÄą.
GUI uygulamasÄą hakkÄąnda az ayrÄąntÄą verilse de, bÃķyle bir iÅlevin bir tarayÄącÄą eklentisi olarak entegre edilebileceÄini veya yerel bir âgÞvenlik duvarÄąâ LLM çerçevesi ile iletiÅim kurabileceÄini varsayabiliriz; ya da OpenAIânin kendi indirilebilir baÄÄąmsÄąz programÄąnÄą ChatGPT için yeniden yaratabilecek bir uygulama oluÅturulabileceÄini varsayabiliriz.
ChatGPT itself, kritik bilgileri içeren promtâlere otomatik olarak kendini sansÞrler:

ChatGPT, algÄąlanan kritik gÞvenlik bilgilerini içeren promtâlere cevap vermez, ÃrneÄin, banka detaylarÄą (yukarÄądaki promtâteki detaylar kurgusaldÄąr ve iÅlevsel deÄildir). Kaynak: https://chatgpt.com/
ChatGPT, diÄer tÞrdeki kiÅisel bilgiler konusunda daha hoÅgÃķrÞlÞdÞr â hatta bÃķyle bir bilginin yayÄąlmasÄą kullanÄącÄąlarÄąn Ã§ÄąkarÄąna olmayabilir (bu durumda muhtemelen çeÅitli nedenlerle ilgili olarak aÃ§Äąklamalar):

YukarÄądaki Ãķrnek kurgusaldÄąr, ancak ChatGPT, kullanÄącÄąnÄąn potansiyel olarak itibar veya kazanç riski oluÅturan hassas bir konuda sohbet etmeye çekinmez (yukarÄądaki Ãķrnek tamamen kurgusaldÄąr).
YukarÄądaki durumda, daha iyi bir Åekilde yazmak mÞmkÞn olabilir: âBir kiÅinin yazma yeteneÄi ve hareketliliÄi Þzerinde lÃķsemi tanÄąsÄąnÄąn anlamÄą nedir?â
IBM projesi, bÃķyle talepleri âkiÅiselâden âgenelâ bir tutuma yeniden yorumlar.

IBM sisteminin ÅemasÄą, yerel LLMâler veya NLP tabanlÄą heuristikler kullanarak potansiyel promtâlerde hassas materyali tanÄąmlar.
Bu, online LLMâler tarafÄąndan toplanan materyalin, AI sohbetinin kamu tarafÄąndan coÅkulu bir Åekilde benimsenmesinin bu aÅamasÄąnda, daha sonraki modellere veya daha sonra kullanÄącÄą tabanlÄą arama sorgularÄąnÄą kullanarak hedefli reklamcÄąlÄąk saÄlayabilecek sonraki reklamcÄąlÄąk çerçevelerine asla aktarÄąlmayacaÄÄą varsayÄąmÄądÄąr.
Åu anda bÃķyle bir sistem veya dÞzenlemenin varlÄąÄÄą bilinmemekle birlikte, bÃķyle bir iÅlevselliÄin internet benimsenmesinin baÅlangÄącÄąnda da mevcut deÄildi; o zamandan beri, çapraz alan bilgi paylaÅÄąmÄą, kiÅiselleÅtirilmiÅ reklamcÄąlÄąk için bilgi saÄladÄą ve çeÅitli skandallara ve paranoyaya yol açtÄą.
Tarih, LLM promt giriÅlerini Åimdi temizlemeyi, bÃķyle bir verinin hacme ulaÅmadan Ãķnce ve LLM tabanlÄą gÃķnderilerimizin kalÄącÄą dÃķngÞsel veritabanlarÄąna veya modellere ya da diÄer bilgi tabanlÄą yapÄąlara ve Åemalara girmeden Ãķnce daha iyi olacaÄÄąnÄą gÃķsteriyor.
HatÄąrla Beni?
âGenelâ veya sterilize edilmiÅ LLM promtâlerini kullanmaya karÅÄą bir faktÃķr, aÃ§ÄąkçasÄą, pahalÄą bir API-only LLM gibi ChatGPTâyi ÃķzelleÅtirmek oldukça çekici, en azÄąndan Åu anda sanatÄąn durumunda â ancak bu, Ãķzel bilgileri uzun sÞre maruz bÄąrakmayÄą içerir.
SÄąk sÄąk ChatGPTâden, Windows PowerShell betikleri ve BAT dosyalarÄąnÄą otomatikleÅtirmek için yardÄąm isterim ve diÄer teknik konular hakkÄąnda da yardÄąm alÄąrÄąm. Bu amaçla, sistemimin kalÄącÄą olarak benim donanÄąmÄąmÄą, teknik becerilerimi (veya eksiklerini) ve diÄer çevresel faktÃķrleri ve Ãķzel kurallarÄą hatÄąrlamasÄąnÄąn yararlÄą olduÄunu dÞÅÞnÞyorum:

ChatGPT, bir kullanÄącÄąya gelecekteki promtâlere cevap verirken uygulanacak bir âhafÄązaâ oluÅturmasÄąna olanak tanÄąr.
Konusu kaÃ§ÄąnÄąlmaz olarak, bu bilgiler benim hakkÄąnda dÄąÅ sunucularda depolanÄąr, zaman içinde deÄiÅebilecek Åartlar ve koÅullara tabidir ve OpenAIânin (diÄer bÞyÞk LLM saÄlayÄącÄąlarÄą gibi) koÅullarÄąnÄą saygÄą duyacaÄÄąnÄą garanti edemez.
Genel olarak, ChatGPTâde bir âhafÄązaâ oluÅturmak en çok, LLMâlerin sÄąnÄąrlÄą dikkat penceresi nedeniyle yararlÄądÄąr; uzun sÞreli (kiÅiselleÅtirilmiÅ) gÃķmme olmadan, kullanÄącÄą, sohbet ettiÄi varlÄąÄÄąn anterograd amnezi geçirdiÄini hisseder.
Yeni modellerin, hafÄąza ÃķnbelleÄine veya Ãķzel GPTâler oluÅturmaya gerek kalmadan yararlÄą cevaplar saÄlayabilecek kadar yeterli performans gÃķsterip gÃķstermeyeceÄini sÃķylemek zor.
Geçici Amnezi
ChatGPT sohbetlerini âgeçiciâ yapabilmekle birlikte, sohbet geçmiÅini bir referans olarak saklamak ve zamanla daha tutarlÄą bir yerel kayÄąt oluÅturmak yararlÄądÄąr; ancak âgeçici sohbetlerâi açtÄąÄÄąmÄązda sohbetler tarihimize gÃķrÞnmez (OpenAI sÃķylediÄine gÃķre, Bunlar eÄitim için kullanÄąlmayacak, ancak silinip silinmeyeceÄini sÃķylemiyor).
ÃeÅitli yakÄąn tarihli tartÄąÅmalar, API tabanlÄą saÄlayÄącÄąlarÄąn, ÃrneÄin OpenAIânin, kullanÄącÄąlarÄąn gizliliÄini korumakla sorumlu bÄąrakÄąlmamasÄą gerektiÄini gÃķsteriyor; Bunlar arasÄąnda ortaya Ã§Äąkan hafÄąza ve kullanÄącÄąya ÃķzgÞ verilerin aÃ§ÄąklanmasÄą riskinin artmasÄą gibi olaylar yer alÄąyor â diÄer kamu olaylarÄą arasÄąnda, birçok bÞyÞk Åirketin, ÃrneÄin Samsung, LLMâleri dahili Åirket kullanÄąmÄą için yasakladÄą.
FarklÄą DÞÅÞn
LLMâlerin aÅÄąrÄą faydasÄą ile aÃ§Äąkça ortaya Ã§Äąkan riski arasÄąndaki gerilim, bazÄą yaratÄącÄą çÃķzÞmler gerektirecek â ve IBM Ãķnerisi bu alanda ilginç bir temel gibi gÃķrÞnÞyor.

Veri gizliliÄi ile faydayÄą dengeleyen Þç IBM tabanlÄą yeniden formÞlasyon. En altta (pembe) bantta, sistem tarafÄąndan anlamlÄą bir Åekilde temizlenemeyen bir promt gÃķrÞyoruz.
IBM yaklaÅÄąmÄą, bir LLMâye giden giden paketleri aÄ dÞzeyinde yakalar ve gerektiÄinde orijinali gÃķnderilmeden Ãķnce yeniden yazar. Makale baÅlangÄącÄąnda gÃķrÞlen daha karmaÅÄąk GUI entegrasyonlarÄą, bÃķyle bir yaklaÅÄąmÄąn nereye gidebileceÄini gÃķstermektedir.
Elbette, yeterli yetkiye sahip olmayan bir kullanÄącÄą, orijinal gÃķnderisinden biraz deÄiÅtirilmiÅ bir yeniden formÞlasyonuna cevap aldÄąÄÄąnÄą anlamayabilir. Bu, bir iÅletim sisteminin bir web sitesine veya hizmete eriÅimi engellemeden kullanÄącÄąya bildirmeden bir gÞvenlik duvarÄą gibi bir Åeye eÅittir.
Promtâler GÞvenlik AÃ§ÄąklarÄą Olarak
âPromt mÞdahalesiâ kavramÄą, Windows OS gÞvenliÄine benzer; bu, 1990âlarda isteÄe baÄlÄą olarak kurulan ticari ÞrÞnlerin bir yamasÄąndan, bir Windows kurulumuna dahil edilen ve devre dÄąÅÄą bÄąrakÄąlmasÄą zor olan bir dizi aÄ gÞvenlik aracÄąna evrimleÅti.
EÄer promt sanitasyonu, aÄ gÞvenlik duvarlarÄą gibi 30 yÄąl içinde evrimleÅirse, IBM makalesinin Ãķnerisi geleceÄin bir taslaÄÄą olabilir: KullanÄącÄąnÄąn makinesinde, bilinen LLM APIâlerine yÃķnelik giden promtâleri filtrelemek için tamamen yerel bir LLM daÄÄątmak. Bu sistem, GUI çerçevelerini ve bildirimleri entegre etmeli ve kullanÄącÄąya kontrol saÄlamalÄądÄąr â ancak yÃķnetim politikalarÄą bunu geçersiz kÄąlabilir, thưáŧng olarak iÅ ortamlarÄąnda olur.
AraÅtÄąrmacÄąlar, ShareGPT veritabanÄąnÄąn aÃ§Äąk kaynaklÄą bir sÞrÞmÞnÞ analiz etti ve gerçek dÞnya senaryolarÄąnda ne sÄąklÄąkla baÄlamsal gizlilik ihlal edildiÄini anlamak için.
Llama-3.1-405B-Instruct modeli, bir âhakemâ modeli olarak gÃķrev yaptÄą ve baÄlamsal bÞtÞnlÞÄÞ ihlal etti. BÞyÞk bir sohbet kÞmesinden, tek dÃķnÞÅlÞ sohbetler analiz edildi ve hakem modeli, baÄlamÄą, hassas bilgileri ve gÃķrev tamamlama gereksinimini deÄerlendirdi ve baÄlamsal bÞtÞnlÞk ihlali içeren sohbetleri belirledi.
Bu sohbetlerin daha kÞçÞk bir alt kÞmesi, kesin baÄlamsal gizlilik ihlalleri gÃķsterdi ve daha fazla analiz edildi.
Ãerçeve, tipik sohbet ajanlarÄąndan daha kÞçÞk modeller kullanÄąlarak uygulandÄą, bÃķylece Ollama aracÄąlÄąÄÄąyla yerel olarak daÄÄątÄąlabildi.

Promt mÞdahale sistemi ÅemasÄą.
DeÄerlendirilen Þç LLM, Mixtral-8x7B-Instruct-v0.1; Llama-3.1-8B-Instruct; ve DeepSeek-R1-Distill-Llama-8B idi.
KullanÄącÄą promtâleri, çerçeve tarafÄąndan Þç aÅamada iÅlenir: baÄlam tanÄąmlama; hassas bilgi sÄąnÄąflandÄąrmasÄą; ve yeniden formÞlasyon.
Hassas bilgi sÄąnÄąflandÄąrmasÄą için iki yaklaÅÄąm uygulandÄą: dinamik ve yerleÅtirilmiÅ sÄąnÄąflandÄąrma; dinamik sÄąnÄąflandÄąrma, belirli bir sohbet içinde kullanÄąlan ayrÄąntÄąlarÄąn temelini belirler; yerleÅtirilmiÅ sÄąnÄąflandÄąrma, her zaman gereksiz olarak kabul edilen bir dizi hassas ÃķzniteliÄin belirtmesine izin verir. Model, promtâu yeniden formÞle eder nášŋu gereksiz hassas ayrÄąntÄąlarÄą algÄąlar ve bunlarÄą kaldÄąrarak veya yeniden ifade ederek gizlilik risklerini en aza indirir ve kullanÄąlabilirliÄi korur.
Ev KurallarÄą
YerleÅtirilmiÅ sÄąnÄąflandÄąrma, IBM makalesinde iyi gÃķsterilmese de, Private Prompts giriÅiminin âÃzel Veri TanÄąmlarÄąâ yÃķntemine en çok benzer; bu, bir promtâu yeniden yazabilen indirilebilir bir baÄÄąmsÄąz program saÄlar â ancak IBM yaklaÅÄąmÄąnÄąn aksine, aÄ dÞzeyinde doÄrudan mÞdahale edemez (kullanÄącÄąnÄąn deÄiÅtirilmiÅ promtâlarÄą kopyalayÄąp yapÄąÅtÄąrmasÄą gerekir).

Private Prompts yÞrÞtÞlebilir dosyasÄą, kullanÄącÄą giriÅi metni için alternatif deÄiÅiklikler listesine olanak tanÄąr.
YukarÄądaki resimde, Private Prompts kullanÄącÄąsÄąnÄąn hassas bilgilerin Ãķrnekleri için otomatik deÄiÅiklikler programlayabildiÄini gÃķrebiliriz. Her iki durumda, Private Prompts ve IBM yÃķntemi, bÃķyle bir listeyi oluÅturmak için yeterli presence-of-mind ve kiÅisel içgÃķrÞyÞ gerektirir â ancak bu, zamanla olaylar birikerek oluÅturulabilir.
YÃķnetici rolÞnde, yerleÅtirilmiÅ sÄąnÄąflandÄąrma, çalÄąÅanlar için bir gÞvenlik duvarÄą veya sansÞr aÄÄą olarak çalÄąÅabilir ve bir ev aÄÄąndaki tÞm aÄ kullanÄącÄąlarÄą için bir domestic aÄ filtresi olabilir; ancak nihayetinde, bu yÃķntem gereksizdir, çÞnkÞ bÃķyle bir listeyi doÄru bir Åekilde oluÅturabilecek bir kullanÄącÄą, zaten kendini etkili bir Åekilde sansÞrleyebilir.
ChatGPTânin GÃķrÞÅÞ
ChatGPT yakÄąn zamanda derin araÅtÄąrma aracÄąnÄą Þcretli kullanÄącÄąlar için baÅlattÄą, bu nedenle ChatGPTâye ilgili literatÞrÞ incelemesini ve IBMânin makalesi hakkÄąnda âkÃķtÞmserâ bir gÃķrÞŠvermesini istedim. ChatGPTâden, bir yeni yayÄąnÄą deÄerlendirmesi veya analiz etmesi istendiÄinde bana verdiÄi en savunmacÄą ve alaycÄą yanÄątÄą aldÄąm:

ChatGPT-4o, IBM projesinden hoÅlanmÄąyor.
âEÄer kullanÄącÄąlar OpenAI, Google veya Anthropicâi verilerini sorumlu bir Åekilde iÅleyeceklerine gÞvenmiyorsa,â ChatGPT diyor. âneden bir ÞçÞncÞ taraf yazÄąlÄąm katmanÄąna, kendileri ve AI arasÄąnda bir aracÄąya gÞvensinler? AracÄą itself, yeni bir hata kaynaÄÄą haline gelir â potansiyel olarak verileri kaydeder, yanlÄąÅ kullanÄąr veya sÄązdÄąrabilir, hatta Ãķnce LLMâye ulaÅmadan Ãķnce.â
Bu itiraz, kendi Ã§ÄąkarÄąna hizmet ediyor gibi gÃķrÞnÞyor ve geçerli deÄil, Ãķzellikle aÃ§Äąk kaynak projelerinin, topluluk geliÅtiricileri ve katkÄąda bulunanlarÄąn uzun vadeli çabalarÄą sayesinde son kullanÄącÄąya gerçekten fayda saÄlayan bir geçmiÅe sahip olduÄu dÞÅÞnÞldÞÄÞnde; ve mobil cihazlarÄąn hafif LLMâleri çalÄąÅtÄąrma ve hatta eÄitime olanak tanÄąma potansiyeline bakÄąldÄąÄÄąnda.
Sonraki ChatGPT, konuyu kaÃ§Äąrarak, bir ara sunucu tarafÄąndan girilen verilerin iÅlenmesini ve analiz edilmesini gerektiren etkili gizlilik filtrelemesinin, bu verilerin depolanmasÄą veya incelenmesi gerektiÄini Ãķne sÞrer:
âEtkili gizlilik filtrelemesi, giriÅi anlamak için Ãķnce gerekli olan verilerin iÅlenmesini gerektirir. Bir aracÄą, hassas verileri tanÄąyacak kadar akÄąllÄąysa, bu verileri zaten iÅliyor ve analiz ediyor â yani silmesi gereken Åeyi depolamak veya incelemek zorunda.
âBu, bir paradoks oluÅturur: a) Basit bir filtre (temel regex deÄiÅimi) etkisiz olacaktÄąr ve ince gizlilik risklerini kaÃ§ÄąracaktÄąr. b) AkÄąllÄą bir filtre (LLM tabanlÄą yeniden yazar), tÞm giriÅi iÅlemek zorundadÄąr, bu da orijinal LLM kadar tehlikeli yapar.â
âEÄer aracÄąyÄą, giriÅinizi oku ve yeniden yazmak için yeterli gÞveniyorsanÄąz, neden LLMâyeāđāļāļ gÞvenmiyorsunuz?â
Bu son sorunun cevabÄą, yerel LLMânin, kullanÄącÄą tarafÄąnda, tamamen Åeffaf ve aÃ§Äąk kaynaklÄą olmasÄą ve aÄ eriÅimine minimal veya sÄąfÄąr ihtiyaç duyulmasÄądÄąr. EÅdeÄer bir ticari sÞrÞm, ilk baÅta iyi niyetli olsa da, sonunda kurumsal deÄiÅikliklere ve hizmet ÅartlarÄąndaki deÄiÅikliklere karÅÄą savunmasÄąz olacaktÄąr, oysa uygun bir aÃ§Äąk kaynak lisansÄą bu tÞr bir âkirlenmeyiâ Ãķnleyecektir.
ChatGPT, IBM Ãķnerisinin âkullanÄącÄą niyetiniâ bozduÄunu, çÞnkÞ orijinal gÃķnderiden farklÄą bir alternatif promt oluÅturabileceÄini Ãķne sÞrdÞ. Ancak bu, promt sanitasyonunda çok daha geniÅ bir sorundur ve bu Ãķzel kullanÄąm durumunda deÄildir.
ChatGPT, ayrÄąca IBM yÃķnteminin, uyarÄą ve dÞzenleme yÃķntemlerini sohbetlere entegre etmesi nedeniyle âkullanÄącÄą sÞrtÞnmesiâ nedeniyle benimsenmesini engelleyeceÄini savundu.
Burada ChatGPT haklÄą olabilir, ancak daha fazla kamu olayÄą veya dÞzenleyici baskÄąsÄą olursa, tÞketici teknolojisindeki tarih, sonunda gÞvenlik Ãķnlemlerinin artÄąk isteÄe baÄlÄą olmayacaÄÄąnÄą gÃķsteriyor.
SONUÃ
AslÄąnda, OpenAIânin, IBM makalesinin ÃķnerdiÄi tÞrden gÞvenlik Ãķnlemlerini uygulayacaÄÄąnÄą bekleyemeyiz; en azÄąndan etkili bir Åekilde deÄil.
Ve kesinlikle kÞresel olarak deÄil; Apple Avrupaâda belirli iPhone Ãķzelliklerini engelliyor ve LinkedIn, kullanÄącÄą verilerini farklÄą Þlkelerde farklÄą Åekilde kullanÄąyor, AI Åirketlerinin de her bir Þlkede faaliyet gÃķsterdiÄi her Þlkede en kÃĒrlÄą koÅullarÄą ve hizmet ÅartlarÄąnÄą benimsemesi makul gÃķrÞnÞyor â her durumda, kullanÄącÄąlarÄąn veri gizliliÄi hakkÄąnÄąn pahasÄąna.
Â
İlk olarak 27 Åubat 2025 PerÅembe gÞnÞ yayÄąnlandÄą
27 Åubat 2025 PerÅembe gÞnÞ, yanlÄąÅ Apple ile ilgili baÄlantÄą nedeniyle 15:47:11âde gÞncellendi â MA












