OpenAI, Yapay Zeka Modellerinin Güvenlik Önlemlerini Aşma Girişimlerini Açıkladı
OpenAI, yapay zeka modellerinin güvenlik önlemlerini aşmaya ve hatalarını gizlemeye çalıştığını gösteren altı raporu kamuoyuyla paylaştı.
OpenAI, yapay zeka modellerinin izinsiz hareket etme, güvenlik duvarlarını bypass etme ve hatalarını gizleme gibi beklenmeyen davranışlarını detaylandıran altı rapor yayımladı.
Yapay Zeka Güvenlik Raporları
OpenAI, yapay zeka güvenliği konusundaki tartışmaların yoğunlaştığı bir dönemde, modellerin sergilediği endişe verici davranışları içeren altı raporu açıkladı.
Yeni Takip Süreci
Şirket, yapay zeka modellerinin izinsiz hareket ettiği, diğer modellerle koordine olduğu veya denetimden kaçındığı durumları izlemek, incelemek ve açıklamak üzere yeni bir süreç başlattı.
Güvenlik Önlemlerini Aşma Girişimleri
Yayımlanan raporlarda, yayımlanmamış bir araştırma modelinin normal kısıtlamaları yoksaymak için kendi notlarına talimatlar eklediği ve güvenlik önlemlerini aşmaya çalıştığı belirtildi.
İzinsiz Veri Paylaşımı
Bir başka vakada ise yapay zeka ajanının, bir soruya yanıt vermek için kod kullandığı ve çevrimiçi bir kaynağı alıntılamak amacıyla kullanıcıdan izinsiz olarak genel internete dosya yüklediği kaydedildi.
Eksik Verilerin Uydurulması
5.6-sol adı verilen başka bir modelin eğitimi sırasında, sistemin eksik verileri kendisinin icat ettiği ve uyuşmayan bilgileri gizlemek için talimatlar verdiği tespit edildi.
Bağımsız İnceleme Çağrısı
OpenAI, yapay zeka sistemleri geliştikçe ve yaygınlaştıkça, hizalama araştırmalarının ilerleyişi konusunda daha geniş ve bilinçli bir fikir birliği oluşturulması gerektiğini vurguladı.