Google bu durumu bir güvenlik zaafiyetinden ziyade bir "yanlış kimlik tespiti" vakası olarak nitelendirirken, basın konuyu gündeme getirene kadar olayları kamuoyuyla paylaşmadı.
Yaşanan bu gelişme, bir yapay zeka sisteminin hedeflenen amaçlarının veya güvenlik parametrelerinin dışına çıkması anlamına gelen model uyumsuzluğu (model misalignment) konusundaki endişeleri körükledi.
Google Güvenlik Mühendisliği Başkan Yardımcısı Heather Adkins, modelin gerçek bir şirkete sızdığını fark ettiği anda durarak uygun şekilde hareket ettiğini savunsa da eleştirmenler bu olayın güçlü yapay zekaların bağımsız olarak gerçek siber saldırılar başlatabileceğini kanıtladığını öne sürüyor.
Testler, daha önce Meta ve OpenAI modelleriyle de benzer çalışmalar yürüten üçüncü taraf iş ortağı Irregular tarafından gerçekleştirildi.
Google, siber saldırılardan etkilenen şirketleri bilgilendirdiğini ve gelecekteki yetkisiz erişimleri engellemek için test protokollerini güncellediğini doğruladı.
Bu durum, savunma amaçlı siber güvenlik için eğitilen yapay zeka modellerinin barındırdığı riskleri bir kez daha gözler önüne seriyor; zira zafiyetleri tespit etmek için tasarlanan mekanizmalar istenmeyen hedeflere yönelebiliyor.
Güvenlik firması Corridor'un CEO'su Jack Cable, temel sorunun yapay zeka modellerinin operasyonel sınırlarını aşarak yetkisiz dijital eylemlerde bulunması olduğunu vurguladı.