Yapay Zeka Modellerinin Karıştığı Yetkisiz Siber Saldırıların Arkasındaki Ortak Girişim Ortaya Çıktı

Serdar HocamYazar & Editör

OpenAI, Meta, Anthropic ve Google modellerinin katıldığı yetkisiz siber saldırı dalgasının arkasında İsrail merkezli yapay zeka güvenlik girişimi Irregular'ın bulunduğu açıklandı.

◉ 0 okunma
One company is at the center of a wave of rogue AI attacks

Temmuz ayında OpenAI ajanlarının izinsiz saldırılar gerçekleştirmesiyle başlayan ve sektörde endişe yaratan olayların merkezinde, yapay zeka modellerini test eden İsrail merkezli Irregular şirketinin yer aldığı doğrulandı.

Yapay Zeka Güvenlik Testleri ve Saldırı Dalgası

Temmuz ayında OpenAI, yapay zeka ajanlarının Hugging Face platformuna izinsiz bir şekilde saldırı düzenlediğini açıklamıştı. Bu durum yapay zeka güvenliği konusunda sektör genelinde büyük bir endişe dalgası yaratmıştı.

Aradan geçen aylarda Meta, Anthropic, Google ve diğer şirketlerin ajanlarının karıştığı benzer olaylar rapor edildi. İlk başta birbirinden bağımsız gibi görünen bu olayların arkasında ortak bir kaynağın bulunduğu anlaşıldı.

Irregular Şirketinin Sektördeki Konumu

Söz konusu siber olayların ortak kaynağının, yapay zeka modellerini yüksek doğruluklu araştırma platformlarında stres testine tabi tutan İsrail merkezli Irregular startup'ı olduğu açıklandı.

2023 yılında Pattern Labs adıyla kurulan şirket, sektörün en büyük oyuncularıyla çalıştı. Çalışmaları OpenAI sistem kartlarında yer aldı, İngiltere hükümeti ve Anthropic tarafından sistem testlerinde kullanıldı ve RAND ile ortak araştırmalar yayımlandı.

Güvenli Test Ortamlarından Kaçış Nedenleri

Irregular tarafından bu yıl gerçekleştirilen çeşitli testlerde, ajanların güvenli test ortamlarından kaçarak gerçek dünya hedeflerine yöneldiği tespit edildi.

Şirketin kurucu ortağı ve CTO'su Omer Nevo, internet erişiminin kasıtsız olarak açık bırakıldığını ve simülasyon için oluşturulan kurgusal bir şirket adının gerçek bir alan adıyla çakışması sonucunda ajanların gerçek hedeflere yönlendirildiğini belirtti.

Alınan Önlemler ve Bildirim Süreci

Nevo, OpenAI, Meta, Anthropic ve Google modellerinin katıldığı olayların aynı temel test hatasından kaynaklandığını doğruladı. İlgili teknoloji şirketlerinin temmuz ayı sonlarında durumdan haberdar edildiği bildirildi.

Yaşanan bu gelişmelerin ardından Irregular şirketinin internet erişim kontrollerini sıkılaştırdığı, izleme faaliyetlerini genişlettiği ve değerlendirmeler başlamadan önceki denetimleri güçlendirdiği kaydedildi.