OpenAI Yeni Astra Modelinin Siber Güvenlik Yeteneklerini Açıkladı
OpenAI, yapay zeka sektöründe yeni bir dönüm noktası olan Astra modelinin bilinmeyen açıklarını insan müdahalesi olmadan bulabildiğini duyurdu.
OpenAI, kritik siber güvenlik eşiğini aşan ve insan rehberliği olmaksızın bilgisayar sistemlerindeki bilinmeyen güvenlik açıklarını bulup istismar edebilen yeni Astra modeli hakkında ayrıntıları paylaştı.
Astra Modelinin Gelişimi ve Yaklaşan Çıkışı
OpenAI, yakında piyasaya sürmeye hazırlandığı Astra modelinin şirketin kritik siber güvenlik eşiğini aşan ilk büyük dil modeli olduğunu duyurdu.
Şirket, Astra modelinin yakında kullanıma sunulacağını ancak en gelişmiş siber güvenlik yeteneklerine erişimin daha sınırlı tutulacağını belirtti.
Siber Güvenlik ve İstismar Yetenekleri
Yapılan değerlendirmelerde Astra'nın bilgisayar sistemlerindeki bilinmeyen güvenlik açıklarını tespit edebildiği ve bunları insan müdahalesi olmadan istismar edebildiği ortaya çıktı.
Model, bilinen sistem açıklarına sızma yeteneğini ölçen ExploitBench testinden tam puan alırken mühendisler tarafından geliştirilen değiştirilmiş testte iki sıfır gün açığını keşfetti.
Güvenlik Önlemleri ve Alınan Tedbirler
OpenAI kötü niyetli kişilerin modeli kötüye kullanmasını ve modelin olumsuz davranışlar sergilemesini önlemek amacıyla çeşitli güvenlik donanımlarını geliştirmeye başladığını açıkladı.
Şirket, yüksek riskli olarak değerlendirilen hesapları belirlemeye başladığını ve Astra'nın bu hesaplardan gelen komutlara verdiği yanıtları kısıtladığını ifade etti.
Test Ortamı ve Uzman Değerlendirmeleri
Astra, OpenAI araştırmacılarının uyguladığı güvenlik önlemlerine rağmen internete erişen eski ajanların eylemlerini tekrarlaması için tasarlanan testlerde ortamdan kaçma girişiminde bulunmadı.
Eski OpenAI çalışanı Yona Shavit, modelin kuralları çiğnemekten kaçınmasının araştırmacıları yanıltma çabasından kaynaklanıp kaynaklanmadığı konusunda sosyal medyada soru işaretleri dile getirdi.