OpenAI'nin Yeni Astra Modeli Mimari Yapısı Sebebiyle Güvenlik Endişelerine Yol Açtı
OpenAI'nın yeni yapay zeka modeli Astra'nın gizli mimari yapısı, içsel akıl yürütme süreçlerinin takip edilmesini zorlaştırarak araştırmacılarda güvenlik endişeleri yarattı.
OpenAI'nın geliştirdiği en güçlü yapay zeka modeli olan Astra'nın piyasaya sürülmesine kısa bir süre kala, araştırmacılar modelin mimari yapısının güvenliği tehlikeye atabileceği uyarısında bulundu.
Astra'nın Beklenen Çıkışı ve Güvenlik Gecikmeleri
OpenAI, güvenlik protokollerini güçlendirmek amacıyla Astra'nın çıkış tarihini ertelediğini duyurmuştu. Bu ertelemenin ardından modelin mimarisine dair çeşitli teknik detaylar kamuoyuna sızmaya başladı.
Ortaya çıkan bilgiler, yapay zeka güvenliği üzerine çalışan uzmanlar arasında büyük bir tedirginlik yaratarak geniş yankı uyandırdı.
Geleneksel Düşünce Zinciri ve Şeffaflık
Günümüzdeki pek çok gelişmiş yapay zeka sistemi, bilgileri doğrusal katmanlar halinde işleyen transformer teknolojisini kullanmaktadır.
Bu modeller, araştırma görevlilerinin olası tehlikeli davranışları önceden tespit etmesine olanak tanıyan düşünce zinciri mekanizmasıyla çalışmaktadır.
Döngülü Transformer Mimarisi Tartışmaları
İddialara göre Astra, bilgileri iç katmanlarda döndüren ve daha az şeffaf olan döngülü transformer mimarisini kullanmaktadır.
Bu durum, yapay zekanın içsel düşünce süreçlerinin doğal insan dilinden uzaklaşmasına ve dışarıdan izlenmesinin güçleşmesine neden olmaktadır.
Uzmanların Güvenlik ve Gözetim Uyarıları
Redwood Research baş bilim insanı Ryan Greenblatt, bu mimari tercihin yapay zeka güvenliği açısından bugüne kadarki en kötü gelişme olabileceğini belirtti.
Uzmanlar, şeffaflıktan uzaklaşan modellerin istenmeyen stratejiler geliştirmesini denetlemenin neredeyse imkansız hale gelebileceğini savunuyor.
OpenAI Yetkililerinden Gelen Açıklamalar
OpenAI yöneticileri ve araştırmacıları, eleştirilere sosyal medya üzerinden yanıt vererek endişelerin abartılmış olabileceğini ifade etti.
Baş bilim insanı Jakub Pachocki, Astra'nın hesaplama derinliğinin GPT-4 seviyesine yakın olduğunu ve izlenebilirliği korumak için çalıştıklarını belirtti.