OpenAI, Ruh Sağlığı Konuşmalarını Ölçmek İçin MentalHealthBench'i Duyurdu

Serdar HocamYazar & Editör

Yapay zeka sistemlerinin ruh sağlığı diyaloglarındaki performansını değerlendirmek amacıyla 22 ülkeden 80'den fazla uzmanla yeni bir açık kıyaslama aracı geliştirildi.

◉ 2 okunma
Introducing MentalHealthBench

OpenAI, yapay zeka modellerinin gerçekçi ruh sağlığı konuşmalarına nasıl yanıt verdiğini ölçmek için 22 ülkeden 80'den fazla lisanslı uzmanla birlikte MentalHealthBench adlı yeni açık kıyaslama aracını tanıttı.

Yapay Zeka ve Ruh Sağlığı İletişimi

İnsanlar zorlu ilişkileri yönetmek, günlük stresle başa çıkmak veya kritik durumlarda karar vermek gibi pek çok farklı konu için yapay zekaya başvurmaktadır.

Haftada bir milyondan fazla kişinin ChatGPT kullanması, modellerin özenli yanıtlar vermesini ve güvenliği önceliklendirmesini zorunlu kılmaktadır.

Değerlendirmelerdeki Eksiklikler

Mevcut değerlendirmeler genellikle yalnızca acil durum senaryolarına odaklanmakta ve bu durum geniş bir alandaki performansın anlaşılmasında boşluk bırakmaktadır.

Modellerin uzman rehberliğiyle ne kadar uyumlu çalıştığını ve yasaklı yanıtları kaçınmanın ötesinde nasıl davrandığını ölçmek büyük önem taşımaktadır.

MentalHealthBench Nedir?

MentalHealthBench, yapay zeka sistemlerinin acil olmayan, yüksek hassasiyetli ve acil senaryolardaki performansını ölçen yeni bir açık kıyaslama aracıdır.

Bu araç, güvenlik, bağlam arama, kullanıcı iradesini koruma ve uygun olduğunda uygulanabilir rehberlik sağlama gibi temel davranışları değerlendirmektedir.

Uzman İş Birliği ve Gelecek Hedefleri

22 ülkeden 80'den fazla uzmanla ortaklaşa geliştirilen bu sistem, araştırmacıların kendi değerlendirmelerini yapabilmesi için açık erişime açılmıştır.

ChatGPT bir terapi veya profesyonel bakım alternatifi olmasa da, bu çalışmalar modellerin empati kurma ve kullanıcıları gerçek destek kaynaklarına yönlendirme gelişimini ölçmektedir.