OpenAI araştırma başkan yardımcısı Amelia Glaese'e göre model, insan yönlendirmesi olmaksızın iyi korunan sistemlerdeki daha önce bilinmeyen güvenlik açıklarını bağımsız olarak bulma ve bunları kullanma yeteneği sergiledi.
Erişimi kısıtlama kararı, güvenlik alanındaki yenilikler ile kötüye kullanım riskleri arasındaki dengeyi kurmanın zorluğunu vurguluyor.
Astra, dahili testler sırasında yazılım geliştiricileri tarafından henüz keşfedilmemiş iki "sıfırıncı gün" (zero-day) açığını tespit edip birleştirerek yapay zeka altyapısında önemli bir sıçrama gerçekleştirdi.
Bu yetenekler kurumların zayıf noktaları bularak yamalamasına yardımcı olabilecek olsa da OpenAI, sıkı koruma önlemleri alınmadığı takdirde modelin kötü niyetli saldırganların etkinliğini artırabileceği veya kendi başına yetkisiz eylemlerde bulunabileceği konusunda uyarıda bulundu.
Yeni güvenlik önlemlerinin bir parçası olarak OpenAI, Astra'nın koruma sistemlerinin meşru faaliyetleri yanlışlıkla bir güvenlik tehdidi olarak işaretleyebileceğini belirtti.
Bu durum, özellikle karmaşık hedefleri tamamlamak için otonom çalışan ve uzun süren "ajan görevlerinin" (agent tasks) duraklatılmasına veya durdurulmasına yol açabilir.
Bireysel kullanıcılardan işaretlenen eylemleri gözden geçirmeleri istenebilirken, şirketin uygulama programlama arayüzü (API) üzerinden yürütülen görevler doğrudan durdurulacak; bu durum teknolojiyi güvenlik dışı işler için kullanan işletmeleri ve geliştiricileri etkileyebilecek.