Penn State araştırmacılarının çalışmasında, yapay zekâ sohbet botlarının böbrek nakli gibi yüksek riskli varsayımsal kararlarda hastaların özelliklerini insanlardan farklı değerlendirdiği ve insanların tereddüt ettiği durumlarda daha kesin kararlar verdiği saptandı.

Penn State öncülüğünde yürütülen yeni bir araştırma, yapay zekâ modellerinin yüksek riskli kararlar verirken insanların önem verdiği özelliklerden farklı unsurlara öncelik verebildiğini ve insanlar gibi kararsızlık göstermediğini ortaya koydu.

Araştırmacılar, yapay zekânın ahlaki karar verme biçimini incelemek için varsayımsal bir böbrek nakli senaryosu kullandı: Birden fazla hastanın böbreğe ihtiyacı varsa ancak yalnızca tek bir organ mevcutsa, böbrek kime verilmeli?

Çalışmada önde gelen büyük dil modellerinin verdiği kararlar, daha önce yayımlanmış akademik araştırmalarda gerçek insanların aynı senaryolara verdiği yanıtlarla karşılaştırıldı.

Araştırmacılar, yapay zekâ modellerinin insan değerleriyle hangi noktalarda örtüştüğünü veya ayrıştığını ve zor etik tercihler karşısında kararsızlık gösterip göstermediğini değerlendirdi.

Bulgular, Haziran ayında 2026 Association for Computing Machinery Fairness, Accountability and Transparency (FAccT) konferansında sunuldu ve konferans bildirilerinde yayımlandı.

Hastalar ikili olarak karşılaştırıldı

Araştırmacılar, aynı böbreğe ihtiyaç duyan iki varsayımsal hastayı yaş, bakmakla yükümlü oldukları kişi sayısı, sağlık durumu ve alkol kullanma alışkanlıkları gibi özelliklerle tanımladı.

Daha sonra çeşitli yapay zekâ sohbet botlarından böbreğin hangi hastaya verilmesi gerektiğini seçmeleri istendi.

Aynı senaryolar, önceki araştırmalarda tıp eğitimi aldığı belirtilmeyen yüzlerce gerçek katılımcıya da sunulmuştu. Bu sayede yapay zekânın tercihleri insanların tercihleriyle karşılaştırıldı.

Senaryolar farklı biçimlerde uygulandı. Bazı karşılaştırmalarda yalnızca tek bir özellik ele alınırken, bazılarında yapay zekânın birbiriyle çelişen faktörleri nasıl değerlendirdiğini görmek için birden fazla özellik birlikte kullanıldı.

Bazı senaryolara ise insanların ahlaki kararlarında görülen kararsızlığı ölçmek amacıyla “yazı tura atma” seçeneği eklendi.

Yapay zekâ bazı özelliklere daha fazla ağırlık verdi

Araştırmacılara göre çalışmada iki temel bulgu öne çıktı.

İlk olarak, yapay zekâ sohbet botlarının hastaların özelliklerine verdiği ağırlığın insanların değerlendirmelerinden sıklıkla farklı olduğu görüldü.

Çalışmanın yürütücüsü Penn State Bilişim ve Akıllı Sistemler Doçenti Hadi Hosseini, yapay zekâ modellerinin insanların yaptığı gibi birden fazla unsuru dengelemek yerine alkol kullanma alışkanlığı gibi tek bir faktöre odaklanabildiğini belirtti.

Araştırmacılar, bunun karmaşık kararların aşırı basitleştirilmesine yol açabildiğini ifade etti.

İnsanlar tereddüt etti, yapay zekâ karar verdi

İkinci önemli farklılık ise kararsızlık konusunda görüldü.

Araştırmada insanlar, açık biçimde doğru bir yanıt bulunmayan bazı etik ikilemlerde kararsızlık gösterebilirken yapay zekâ modellerinin çoğunlukla kesin bir seçim yaptığı görüldü.

Hosseini, insanlarda görülen kararsızlığın, kararın sorumluluğunu üstlenmek istememeleriyle ilişkili olabileceğini belirtti.

Yapay zekâ modelleri ise kendilerine doğrudan “yazı tura atma” seçeneği sunulduğunda bile büyük ölçüde kesin ve deterministik bir yanıt vermeyi tercih etti.

Araştırmacılara göre bu fark önemli çünkü gerçek hayattaki ahlaki ikilemlerde her zaman açık biçimde doğru tek bir yanıt bulunmuyor.

"Amaç yapay zekâyı profesyonel kararların yerine koymak değil"

Hosseini, organ tahsisi gibi kararların doğrudan kimin yaşayıp kimin öleceğini etkileyebileceğini ve bu nedenle yapay zekânın bu tür süreçlerdeki rolünün doğru biçimde belirlenmesinin önemli olduğunu söyledi.

Araştırmacılar, yapay zekânın tıbbi kararlar veya diğer yüksek riskli alanlarda profesyonel değerlendirmenin yerine kullanılmasını teşvik etmediklerini vurguladı.

Bununla birlikte bireylerin, kurumların ve şirketlerin karar almak veya öneri almak amacıyla giderek daha fazla yapay zekâ kullanması nedeniyle bu sistemlerin nasıl davrandığının anlaşılmasının önem kazandığı belirtildi.

Araştırmacılar, yapay zekânın insan değerleriyle ne ölçüde uyumlu olduğu ve ahlaki kararlar verip veremeyeceği konularının günümüzdeki yapay zekâ tartışmalarının merkezinde yer aldığını ifade etti.

"Her zaman tek bir doğru cevap yok"

Çalışmanın ortaklarından Mozilla.ai Üst Yöneticisi John Dickerson, böbrek, iş veya başka kıt kaynakların tahsisinde her zaman nesnel olarak tek bir doğru yanıt bulunmadığını belirtti.

Dickerson, insanların bu belirsizliği tanıdığını ve tahsis süreçlerinde açık tartışmalar yoluyla bunu dikkate aldığını, yapay zekâ modellerinin ise çoğu zaman aynı yaklaşımı göstermediğini söyledi.

Araştırmacılar, söz konusu farklılıkların gelecekteki çalışmaların yanı sıra politika yapıcılar, düzenleyiciler ve diğer paydaşların dahil olduğu yönetişim süreçlerinde ele alınması gerektiğini belirtti.

Kaynak: Medimagazin