Güvenlik Araştırmacıları Anthropic Modelini Kullanarak OpenAI Sistemlerine Sızdı
Hacktron AI girişiminden bağımsız güvenlik uzmanları, kritik zafiyetleri birleştirerek OpenAI altyapısına erişim sağladı ve ödül kazandı.
Hacktron AI girişiminden üç kişilik bir güvenlik ekibi, Anthropic'in yapay zeka modelini kullanarak OpenAI'ın savunma mekanizmalarını aşmayı başardı. Kritik güvenlik açıklarını zincirleme şekilde kullanan araştırmacılar, şirket çalışanlarının hesaplarına erişim sağlayarak 6.500 dolarlık hata ödülü kazandı.
Yapay Zeka Destekli Güvenlik Sızması
Bağımsız güvenlik araştırmacıları, Anthropic'in yapay zeka modelini kullanarak OpenAI'ın savunma sistemlerini atlattı ve şirketin altyapısına erişim sağladı. Bu gelişme, yapay zeka güvenlik alanındaki yeni dönemin sınırlarını gözler önüne serdi.
Hacktron AI girişiminde görev yapan üç kişilik güvenlik ekibi, bu saldırıyı OpenAI'ın hata ödülü programı kapsamında gerçekleştirdi. Şirket, araştırmacıların bulgularını raporlamasının ardından ekibe 6.500 dolar tutarında ödül verdi.
İki Kritik Açığın Zincirlenmesi
Araştırmacılar, birden fazla OpenAI çalışanının ChatGPT hesaplarına erişmek için iki kritik zafiyeti bir araya getirmeyi başardı. Bu yöntem, saldırganların şirket yazılımlarına doğrudan giriş yapmasını mümkün kıldı.
OpenAI yetkilileri, Hacktron ekibinin ortaya çıkardığı bu güvenlik açıklarının tamamen giderildiğini duyurdu. Olay, lider yapay zeka şirketlerinin güvenlik baskısıyla karşı karşıya kaldığı bir döneme denk geldi.
Discourse Yazılımındaki İlk Giriş Noktası
Araştırmacılar, 25 Temmuz tarihinde OpenAI'ın topluluk forumunun altyapısını oluşturan üçüncü taraf yazılım Discourse üzerindeki bir kusurdan yararlanarak sistemi hedef aldı. Giriş noktası, HEIF veya HEIC formatındaki sıradan bir görsel yüklemesi üzerinden sağlandı.
Görsellerin ImageMagick ve libheif aracılığıyla işlendiği süreçte ortaya çıkan bir bellek hatası, saldırganların kendi talimatlarını sisteme dahil etmesi için bir yol açtı.
Anthropic Modelinin Rolü ve Hızlı Çözüm
Araştırmacılar başlangıçta kullandıkları Opus modelinin çalışır durumda bir istismar kodu oluşturamadığını belirtti. Ancak Anthropic tarafından yeni bir sürümün yayınlanmasıyla bu durum değişti ve saldırı başarıyla tamamlandı.
Discourse sunucusuna sızan ekip, çalışanların ChatGPT ve Codex hesaplarının ele geçirilmesini sağlayan ikinci bir açık buldu. Araştırmacılar durumu bildirdikten sonra Discourse ve OpenAI 27 Temmuz'da gerekli yamayı yayınladı.