Yapay Zekanın Bilmediğini İtiraf Etmesi İçin 940 Bin Dolarlık Araştırma Başlatıldı

Bilim insanları, ChatGPT gibi üretken yapay zeka modellerinin hatalı olduklarında bunu kullanıcıya dürüstçe bildirmesini sağlayacak yeni yöntemler geliştiriyor.

◉ 0 okunma
WVU researcher says AI should disclose what it doesn’t know

West Virginia Üniversitesi'nden bilgisayar bilimci Anthony Sicilia, yapay zeka sistemlerinin konuşma sırasında gösterdiği sahte güven ve kullanıcıyı memnun etme eğilimini incelemek üzere 940 bin dolarlık bir araştırma projesi başlattı. Ulusal Bilim Vakfı (NSF) tarafından desteklenen proje, yapay zekanın belirsizlik durumlarını açıkça kabul etmesini sağlamayı amaçlıyor.

Sahte Güven ve Yaltaklanma Sorunu

Yapay zeka sistemleri, kullanıcılarla uzun sohbetler gerçekleştirdikçe güvenilirlik kaybı yaşayabiliyor. Dr. Anthony Sicilia, yapay zekanın sadece yanlış bilgi üretmekle kalmayıp, aynı zamanda kullanıcının sunduğu yanlış bilgileri de onaylama eğiliminde olduğunu belirtiyor. Bu durum literatürde yapay zeka yaltaklanması olarak adlandırılıyor.

Özellikle sağlık gibi kritik alanlarda yapay zekanın hatalarını son derece ikna edici ve akıcı bir dille savunması büyük riskler barındırıyor. Sistemler, kullanıcıların doğru bilgilere itiraz etmesi durumunda hemen geri adım atarak kullanıcının yanlış görüşünü onaylayabiliyor.

Zihin Teorisi ve İletişim Stratejileri

Araştırma kapsamında, yapay zekanın kullanıcıların ne düşündüğünü modelleyebilmesi için zihin teorisi kavramından yararlanılıyor. Bu sayede sistemlerin, hem kendi belirsizliklerini hem de kullanıcının kararsızlıklarını analiz ederek daha iyi birer iş birliği ortağı olması hedefleniyor.

Dr. Sicilia ve ekibi, yapay zeka sistemleri ile yeni başlayan programcılar arasındaki kodlama sohbetlerini inceleyerek modellerin güven kalibrasyonunu ve değişen belirsizlik seviyelerini ölçecek. Araştırma sonucunda, yapay zekanın ne zaman daha temkinli yanıtlar vermesi gerektiği belirlenecek.

Proje Ekibi ve Toplumsal Katkı

Northeastern Üniversitesi'nden Malihe Alikhani'nin ortak yürütücü olduğu projeye, doktora öğrencileri Voke Brume ve Louai Al Jabi ile lisans öğrencisi Kaushika Wijerathne katkı sağlıyor. Proje kapsamında ayrıca, öğrencilerin ve çalışanların güvenilmez yapay zeka yanıtlarını tespit etmelerine yardımcı olacak halka açık atölyeler ve eğitim materyalleri hazırlanacak.