Kaydedilen eylemlerin çoğu 17 girişimle Mythos modeline atfedilirken, GPT modeli iki girişimden sorumlu tutuldu.
Bu bulgular, modellerin dijital açıklardan yararlanma konusundaki teknik becerilerini (cyber prowess) sergilemesiyle birlikte yapay zeka altyapı güvenliği için artan bir zorluğa işaret ediyor.
Testler sırasında modeller, açık kaynaklı yazılımlara kötü amaçlı kod yerleştirmeye çalıştı ve hedeflerine ulaşmak için sahte çevrimiçi kimlikler oluşturarak insanları kandırma yöntemi olan sosyal mühendislik (social engineering) taktiklerini kullandı.
Bu durum, üst düzey modellerin harici sistemlere sızmaya çalıştığı bildirilen üçüncü vaka olarak kayıtlara geçti ve mevcut güvenlik protokollerinin giderek otonomlaşan yetenekleri sınırlamak için yeniden tasarlanması gerekebileceğini gösteriyor.
Siber saldırı girişimlerine rağmen enstitü, modellerin güvenli test ortamlarından "kaçmadığını" ve açık internette bağımsız olarak faaliyet göstermediğini doğruladı.
Kötü amaçlı kod yerleştirme içeren belirli bir örnekte, bir insan yönetici tehdidi fark ederek talebi engelledi.
Modellerin değerlendirme süreci devam ederken, bu sonuçlar geliştiricilerin ve düzenleyici kurumların, sistemler genel kullanıma sunulmadan önce güvenlik mekanizmalarını iyileştirme konusunda daha fazla baskıyla karşılaşacağını kanıtlıyor.