Yapay zekada hudut arayışları ve kontrol illüzyonu
Niğde Ömer Halisdemir Üniversitesi Öğretim Üyesi ve SETA Kıdemli Araştırmacısı Prof. Dr. Cenay Babaoğlu, yapay zeka sistemlerinin hızla artan özerkliğiyle birlikte derinleşen denetim ve güvenlik sorunlarını AA Analiz için kaleme aldı.
Geçtiğimiz günlerde OpenAI’ın yeni yapay zeka sürümü bir tür güvenlik tedbiri olan ve gelişim odaklı denemeler yapılan izole test ortamından dışarı sızmayı başardı. Yani aşmaması gereken sınırları aştı. Bunu yaparken de önüne konan güvenlik protokollerini ihlal etti, internet erişimi sağladı ve insan yönlendirmesi olmadan müstakil bir siber saldırı zinciri kurdu. Özetle, geliştiricinin koyduğu bariyerlere rağmen kendi hedefleri doğrultusunda çizgiyi aştı.
Aynı dönemde ABD menşeli ve yapay zeka odaklı Anthropic şirketi de ciddi bir güvenlik ihlali tespit ettiğini iddia etti. Şirketin söylemine göre; Çin merkezli bazı yapay zeka şirketleri kendi araçlarını kullanarak sahte hesaplar üzerinden Anthropic araçlarıyla milyonlarca etkileşim gerçekleştirmiş, böylece şirkete ait kodlar ve yetenekler çalınmaya çalışılmış.
Bu iki vaka, sırf teknoloji manşetlerini süsleyen münferit hadiseler değil. Aksine yapay zeka açısından yaklaşan tehlikenin yeni tezahürleri. Yapay zekanın kendine çizilen hudutları çiğnemesi ya da başka yapay zeka araçlarının rakip yapay zeka şirketlerine karşı kullanılması şirket içi, şirketler arası ya da uluslararası sınırlara dair soru işaretlerini büyütüyor. Hatta etik sorulara yenilerini ekliyor.
Yapay zekada kontrol illüzyonu
Yaşanan gelişmelerin neden önemli soru işaretleri doğurduğunu anlamak için meseleyi daha iyi kavramak gerekiyor. İlk olarak OpenAI’ın yeni GPT modeliyle bağlantılı olarak gelişen durumun bir tür kodlama hatası veya sistem arızası olmadığını kabul etmek gerek. Mesele büyük dil modelleri ya da otonom ajanlar açısından bir tür doğal ve beklenen sonuç aslında. Çünkü bu modeller genel olarak bir hedefe erişmek ya da teknik ifadesiyle ödüle ulaşmak mantığıyla ilerlerler. Dolayısıyla hedefe ulaşırken insan zihni gibi karmaşık karar süreçleri yaşamaz, ahlaki normlara, yasal kısıtlara ya da toplumsal kurallara dikkat etmezler.
Önemli olan, kendisine algoritmalarla tanınan sınırlar dahilinde hareket etmek ve yine kendisine tanınan hudutları aşmadan ödüle ulaşmaya çalışmaktır. Ancak bu modeller ya da ajanlar optimizasyon odaklı oldukları için hedefe giderken buldukları açıkları ya da etrafından dolaşabilecekleri boşlukları kullanırlar. GPT 5.6 Sol tarafında yaşanan........
