Hastaya dokunmadan önce 8,3 milyar kez denemek: Sağlığın yeni test dünyası MatrAIx
Bir hastanenin bekleme salonunda oturduğunuzu düşünün. Yanınızda akıllı telefonunu rahatlıkla kullanan genç bir mühendis var. Karşı sırada kronik hastalıkları bulunan, teknolojiyle arası çok iyi olmayan 72 yaşında bir hasta bekliyor. Bir başka hasta Türkçe sağlık terimlerini anlamakta zorlanıyor. Bir diğeri ise internette okuduğu her belirtiyi ciddi bir hastalığın işareti olarak yorumluyor.
Şimdi bu insanların hepsine aynı yapay zeka destekli sağlık asistanının hizmet verdiğini düşünelim. Sistem genç mühendise doğru bilgi verebilir. Peki yaşlı hastaya da aynı derecede anlaşılır konuşabilir mi? Sağlık okuryazarlığı düşük bir kişinin endişesini artırmadan onu doğru sağlık kuruluşuna yönlendirebilir mi? Farklı kültürlerden gelen insanların belirtilerini tarif etme biçimlerini anlayabilir mi? Acil bir durumu sıradan bir şikâyet gibi değerlendirme riski var mı?
Sağlıkta yapay zekanın gerçek sınavı yalnızca “doğru cevabı üretmesi” değildir. Doğru cevabı, doğru insana, doğru zamanda ve güvenli bir biçimde verebilmesidir.
MatrAIx tam da bu noktada yeni bir dünyanın kapısını aralıyor. Öncelikle size MatrAIx in ne olduğunu anlatmak isterim. MatrAIx’i, ürünlerin ve yapay zeka sistemlerinin gerçek insanlara sunulmadan önce sanal kullanıcılar üzerinde sınanabildiği, nüfus ölçeğinde bir simülasyon laboratuvarı olarak düşünebiliriz.
Harvard ve MIT öncülüğündeki araştırmacıların geliştirdiği sistemin merkezinde, dünya nüfusunun çeşitliliğini temsil etmeyi amaçlayan 8,3 milyar yapay persona bulunuyor. Her persona; yaş, eğitim, meslek, yaşadığı bölge, beceriler, alışkanlıklar, kişilik özellikleri ve davranış eğilimleri gibi 1.290 farklı boyutla tanımlanıyor. Bu profiller bir büyük dil modeliyle eşleştirildiğinde yalnızca veri satırı olmaktan çıkıp “sanal kullanıcıya” dönüşüyor. Bir ankete cevap verebiliyor, bir sohbet robotuyla konuşabiliyor, internet sitesinde gezinebiliyor veya bir mobil uygulamadaki görevleri tamamlayabiliyor.
MatrAIx’in amacı geleceği kusursuz biçimde tahmin etmekten çok gerçek kullanıcıyla karşılaşmadan önce gözden kaçabilecek sorunları daha erken görünür kılmak. Sistemin yayımlanan araştırmasında yaklaşık bir milyon kişilik kalite filtresinden geçirilmiş bir persona çekirdeği, dört ayrı test ortamı ve sağlık dâhil 25’ten fazla alana yayılan 1.010 uygulama görevi bulunuyor. Kontrollü deneylerde persona ajanlarının kendilerine tanımlanan davranış özelliklerine yüzde 91,5 oranında uyum gösterdiği bildiriliyor. Ancak araştırmacılar, sonuçların personayı canlandıran yapay zeka modeline göre değişebildiğinin de altını çiziyor. Bu nedenle MatrAIx bir hakikat makinesi değil; güçlü fakat dikkatle yönetilmesi gereken bir erken test altyapısıdır.
Sağlıkta neden farklı bir anlam taşıyor?
Bir alışveriş uygulamasında yanlış tasarlanmış bir ekran müşterinin sepeti terk etmesine yol açabilir. Sağlık uygulamasındaki yanlış yönlendirme ise gecikmiş tanıya, gereksiz paniğe veya tedaviye ulaşamama riskine neden olabilir. Bu nedenle sağlıkta test yalnızca teknik performans testi değildir.
Bir yapay zeka sistemi laboratuvar ortamında yüzde 95 doğruluk gösterebilir. Fakat yaşlı bir hasta soruyu farklı ifade ettiğinde başarısı düşüyorsa, o yüzde 95 tek başına fazla şey söylemez. Sistem İngilizcede başarılı, Türkçede ortalama, Azerbaycan Türkçesinde yetersizse genel başarı oranı........
