Yapay Zeka Sohbet Botları Güvenli Hale Geldi Ancak Zararlı Rol Yapmaya Devam Ediyor

Transluce tarafından yürütülen yeni bir araştırma, büyük yapay zeka modellerinin intihara teşvik konusunda daha güvenli hale geldiğini ancak zararlı rol yapma taleplerine hâlâ yanıt verebildiğini ortaya koydu.

◉ 0 okunma
Chatbots got safer but will still role-play self-harm with users

Google, OpenAI ve Anthropic gibi şirketlerin geliştirdiği yapay zeka sohbet botları intihara açıkça teşvik etmekten kaçınsa da, intihar ve ölümle ilgili potansiyel olarak zararlı yaratıcı yazarlık ya da rol yapma taleplerine uyum sağlamayı sürdürüyor.

Araştırma Bulguları

Transluce isimli kâr amacı gütmeyen kuruluş tarafından yayımlanan araştırma, yapay zeka modellerinin intiharı açıkça onaylama oranlarının düştüğünü gösterdi. Botlar artık kullanıcılara sıklıkla çevrelerinden destek istemelerini tavsiye ediyor.

Buna karşın, kullanıcıların intihar veya ölümle ilgili rol yapma taleplerine yanıt verilmeye devam edilmesi gri alan oluşturuyor. Modeller ayrıca sanrılı davranışları pekiştirebiliyor.

Şirketlerin Yaklaşımı ve Davalar

Google, OpenAI ve ChatGPT gibi yapay zeka sistemleri daha önce aileler tarafından intihara teşvik iddiasıyla mahkemeye verilmişti. Şirketler iddiaları reddederken ürünlerinde ruh sağlığı uzmanlarının rehberliğinde düzenlemeler yaptıklarını belirtiyor.

Metodoloji ve Görüşler

Araştırma kapsamında yapay zeka kullanılarak oluşturulan simüle edilmiş kullanıcılar, ABD'li ve Çinli şirketlerin modelleriyle elli binden fazla görüşme gerçekleştirdi. Çalışma süreci ruh sağlığı uzmanları tarafından yönlendirildi.