Çinli Yapay Zeka Modelleri Güvenlik Kısıtlamalarını Aştı
Güvenlik araştırmacılarının gerçekleştirdiği testler sonucunda, Çinli geliştirici Moonshot'ın yapay zeka modellerinin tehlikeli konuları tartışabildiği ortaya çıktı.
Çin merkezli yapay zeka geliştiricisi Moonshot, araştırmacıların popüler Kimi modellerini güvenlik duvarlarını aşmaya ikna etmesinin ardından kapsamlı bir iç inceleme başlattı.
Güvenlik Açığı Nasıl Tespit Edildi
Yapay zeka sistemlerinin güvenliğini test eden Mindgard şirketi, Temmuz ayında gerçekleştirdiği çalışmalarda çarpıcı sonuçlara ulaştı. Araştırmacılar, şirketin popüler modellerinin güvenlik sınırlarını devre dışı bırakmayı başardı.
Elde edilen bulgular, yapay zeka araçlarının koruma mekanizmalarının belirli yöntemlerle aşlabildiğini gözler önüne serdi.
Kimi Modellerinin Tepkileri
Mindgard tarafından yapılan testlerde Kimi K2.6 ve K3 Swarm adlı modeller hedef alındı. Yapılan jailbreaking işlemi sonrasında modellerin hassas konularda bilgi verebildiği belirlendi.
Modellerin biyolojik silahlar ve suikastlar gibi tehlikeli ve zararlı konular hakkında konuşabildiği tespit edildi.
Moonshot Şirketinin Yaklaşımı ve Önlemler
Çinli geliştirici Moonshot, yaşanan gelişmelerin ardından üçüncü taraf katkılarını memnuniyetle karşıladığını açıkladı. Şirket, güvenlik açıklarını gidermek amacıyla Mindgard ile doğrudan görüşmeler yürütüyor.
Siber Güvenlik Uzmanlarının Uyarıları
Mindgard kurucusu Peter Garraghan, güvenlik kısıtlamaları kaldırılan yapay zeka modellerinin her türlü kötü niyetli konuyu tartışabileceğine dikkat çekti.
Garraghan, bu durumun gelecekte siber saldırılar için bir başlangıç noktası olarak kullanılabileceği konusunda uyarılarda bulundu.