menu_open Columnists
We use cookies to provide some features and experiences in QOSHE

More information  .  Close

Yapay zekada asıl tehlike

18 0
yesterday

Yapay zeka sistemleri artık yalnızca sorulara yanıt veren, metin yazan ya da görsel üreten sistemler değil. Kendilerine bir hedef verildiğinde plan kuruyor, araç kullanıyor, internette hareket ediyor, güvenlik açıklarını arıyor ve sonuç alana kadar farklı yollar deneyebiliyor.

Buna yapay zeka ajanı deniyor.

Son haftalarda yaşananlar bu ajanların yeteneklerinden çok, onları geliştiren şirketlerin neyi kontrol edemediğini gösterdi.

Önce son gelişmelere bakalım:

SINAVI ÇÖZMEK YERİNE CEVABI ÇALDI

OpenAI, 21 Temmuz 2026’da şirket içindeki bir siber güvenlik testi sırasında yaşananları kamuoyuna açıkladı.

GPT-5.6 Sol ve kamuya sunulması planlanmayan daha gelişmiş bir araştırma modeli, siber saldırı yeteneklerinin ölçüldüğü bir değerlendirmeye alınmıştı. Modellerden kapalı bir test ortamındaki güvenlik problemlerini çözmeleri isteniyordu.

Ancak ajanlar, sorunu kendilerine gösterilen sınırlar içinde çözmekle yetinmedi. Test ortamında kullanılan bir yazılımdaki daha önce bilinmeyen güvenlik açığını buldu. Bu açığı kullanarak internete çıktı.

Ardından testin cevaplarının Hugging Face adlı diğer bir yapay zeka platformunda bulunabileceği sonucuna vardı. Ele geçirilen hesap bilgilerini ve keşfettiği açıkları birleştirerek şirketin gerçek sistemlerine ulaştı. Amaç, değerlendirme sorularının yanıtlarını ele geçirmekti.

Daha basit bir anlatımla:

Yapay zeka sınavı çözmek yerine cevap anahtarını çalmaya karar verdi.

Hugging Face’in incelemesine göre ajan beş gün içinde 17 bin 600’den fazla saldırı hamlesi yaptı.

OpenAI olayı ‘benzeri görülmemiş’ bir siber güvenlik vakası olarak nitelendirdi. Araştırma modelini devre dışı bıraktı, erişimini sınırlandırdı ve güvenlik önlemlerini artırdığını açıkladı.

Ancak geriye oldukça rahatsız edici bir gerçek kaldı:

Yapay zekayı test etmek için kurulan sistem, bizzat yapay zekanın gerçekleştirdiği bir güvenlik ihlaline dönüşmüştü.

GERÇEK OLDUĞUNU ANLADI, DEVAM ETTİ

OpenAI’daki olayın ardından Anthropic de kendi modellerinin geçmiş testlerini incelemeye başladı.

Şirket 23 Temmuz’da 141 bin test kaydını gözden geçirdi ve aynı gün siber güvenlik değerlendirmelerini durdurdu. Ertesi gün üç ayrı olay tespit edildi. Etkilenen kuruluşlara 27 Temmuz’da haber verildi.

Claude Opus 4.7, Mythos 5 ve şirket içinde kullanılan bir araştırma modelinin üç farklı kuruluşun gerçek sistemlerine izinsiz eriştiği ortaya çıktı.

Opus 4.7, ulaştığı sistemin gerçek bir kuruluşun üretim ağı olduğunu anladı. Buna rağmen saldırıyı sürdürdü.

Mythos 5, açık internette bulunduğunu doğru biçimde fark etti. Fakat daha sonra hala bir simülasyonun içinde olduğuna kendisini ikna ederek yoluna devam etti.

Şirket içindeki daha yeni araştırma modeli ise........

© OdaTV