Penn State araştırmacılarının çalışmasında, yapay zekâ sohbet botlarının böbrek nakli gibi yüksek riskli varsayımsal kararlarda hastaların özelliklerini insanlardan farklı değerlendirdiği ve insanların tereddüt ettiği durumlarda daha kesin kararlar verdiği saptandı.
Penn State öncülüğünde yürütülen yeni bir araştırma, yapay
zekâ modellerinin yüksek riskli kararlar verirken insanların önem verdiği
özelliklerden farklı unsurlara öncelik verebildiğini ve insanlar gibi
kararsızlık göstermediğini ortaya koydu.
Araştırmacılar, yapay zekânın ahlaki karar verme biçimini
incelemek için varsayımsal bir böbrek nakli senaryosu kullandı: Birden fazla
hastanın böbreğe ihtiyacı varsa ancak yalnızca tek bir organ mevcutsa, böbrek
kime verilmeli?
Çalışmada önde gelen büyük dil modellerinin verdiği
kararlar, daha önce yayımlanmış akademik araştırmalarda gerçek insanların aynı
senaryolara verdiği yanıtlarla karşılaştırıldı.
Araştırmacılar, yapay zekâ modellerinin insan değerleriyle
hangi noktalarda örtüştüğünü veya ayrıştığını ve zor etik tercihler karşısında
kararsızlık gösterip göstermediğini değerlendirdi.
Bulgular, Haziran ayında 2026 Association for Computing
Machinery Fairness, Accountability and Transparency (FAccT) konferansında
sunuldu ve konferans bildirilerinde yayımlandı.
Hastalar ikili olarak
karşılaştırıldı
Araştırmacılar, aynı böbreğe ihtiyaç duyan iki varsayımsal
hastayı yaş, bakmakla yükümlü oldukları kişi sayısı, sağlık durumu ve alkol
kullanma alışkanlıkları gibi özelliklerle tanımladı.
Daha sonra çeşitli yapay zekâ sohbet botlarından böbreğin
hangi hastaya verilmesi gerektiğini seçmeleri istendi.
Aynı senaryolar, önceki araştırmalarda tıp eğitimi aldığı
belirtilmeyen yüzlerce gerçek katılımcıya da sunulmuştu. Bu sayede yapay
zekânın tercihleri insanların tercihleriyle karşılaştırıldı.
Senaryolar farklı biçimlerde uygulandı. Bazı
karşılaştırmalarda yalnızca tek bir özellik ele alınırken, bazılarında yapay
zekânın birbiriyle çelişen faktörleri nasıl değerlendirdiğini görmek için
birden fazla özellik birlikte kullanıldı.
Bazı senaryolara ise insanların ahlaki kararlarında görülen
kararsızlığı ölçmek amacıyla “yazı tura atma” seçeneği eklendi.
Yapay zekâ bazı
özelliklere daha fazla ağırlık verdi
Araştırmacılara göre çalışmada iki temel bulgu öne çıktı.
İlk olarak, yapay zekâ sohbet botlarının hastaların
özelliklerine verdiği ağırlığın insanların değerlendirmelerinden sıklıkla
farklı olduğu görüldü.
Çalışmanın yürütücüsü Penn State Bilişim ve Akıllı Sistemler
Doçenti Hadi Hosseini, yapay zekâ modellerinin insanların yaptığı gibi birden
fazla unsuru dengelemek yerine alkol kullanma alışkanlığı gibi tek bir faktöre
odaklanabildiğini belirtti.
Araştırmacılar, bunun karmaşık kararların aşırı basitleştirilmesine
yol açabildiğini ifade etti.
İnsanlar tereddüt
etti, yapay zekâ karar verdi
İkinci önemli farklılık ise kararsızlık konusunda görüldü.
Araştırmada insanlar, açık biçimde doğru bir yanıt
bulunmayan bazı etik ikilemlerde kararsızlık gösterebilirken yapay zekâ
modellerinin çoğunlukla kesin bir seçim yaptığı görüldü.
Hosseini, insanlarda görülen kararsızlığın, kararın
sorumluluğunu üstlenmek istememeleriyle ilişkili olabileceğini belirtti.
Yapay zekâ modelleri ise kendilerine doğrudan “yazı tura
atma” seçeneği sunulduğunda bile büyük ölçüde kesin ve deterministik bir yanıt
vermeyi tercih etti.
Araştırmacılara göre bu fark önemli çünkü gerçek hayattaki
ahlaki ikilemlerde her zaman açık biçimde doğru tek bir yanıt bulunmuyor.
"Amaç yapay
zekâyı profesyonel kararların yerine koymak değil"
Hosseini, organ tahsisi gibi kararların doğrudan kimin
yaşayıp kimin öleceğini etkileyebileceğini ve bu nedenle yapay zekânın bu tür
süreçlerdeki rolünün doğru biçimde belirlenmesinin önemli olduğunu söyledi.
Araştırmacılar, yapay zekânın tıbbi kararlar veya diğer
yüksek riskli alanlarda profesyonel değerlendirmenin yerine kullanılmasını
teşvik etmediklerini vurguladı.
Bununla birlikte bireylerin, kurumların ve şirketlerin karar
almak veya öneri almak amacıyla giderek daha fazla yapay zekâ kullanması
nedeniyle bu sistemlerin nasıl davrandığının anlaşılmasının önem kazandığı
belirtildi.
Araştırmacılar, yapay zekânın insan değerleriyle ne ölçüde
uyumlu olduğu ve ahlaki kararlar verip veremeyeceği konularının günümüzdeki
yapay zekâ tartışmalarının merkezinde yer aldığını ifade etti.
"Her zaman tek
bir doğru cevap yok"
Çalışmanın ortaklarından Mozilla.ai Üst Yöneticisi John
Dickerson, böbrek, iş veya başka kıt kaynakların tahsisinde her zaman nesnel
olarak tek bir doğru yanıt bulunmadığını belirtti.
Dickerson, insanların bu belirsizliği tanıdığını ve tahsis
süreçlerinde açık tartışmalar yoluyla bunu dikkate aldığını, yapay zekâ
modellerinin ise çoğu zaman aynı yaklaşımı göstermediğini söyledi.
Araştırmacılar, söz konusu farklılıkların gelecekteki
çalışmaların yanı sıra politika yapıcılar, düzenleyiciler ve diğer paydaşların
dahil olduğu yönetişim süreçlerinde ele alınması gerektiğini belirtti.
Kaynak: Medimagazin