Doğrulanmış veriler, bu aktörlerin siber saldırıları otomatikleştirmek, muhalifleri gözetlemek ve altı kıtada büyük ölçekli etki operasyonları yürütmek için Claude'u kullandığını gösteriyor.
Bu bulgular, yapay zekanın gelişmiş saldırı operasyonları için daha önce gereken iş gücü ve beceri açıklarını nasıl kapattığını göstermesi açısından kritik önem taşıyor.
Keşif (reconnaissance), zafiyet geliştirme ve veri sızdırma (data exfiltration) gibi görevlerin yapay zeka tabanlı "ajan sürülerine" devredilmesiyle, tekil operatörler artık makine hızında çok kurbanlı kampanyalar yürütebiliyor.
Anthropic, bu ekonomik değişimin maliyet dengesini bozarak savunmacıların üzerindeki yükü artırdığını ve otonom şekilde gelişen kötü amaçlı yazılımlara karşı koymayı zorlaştırdığını belirtiyor.
Geleceğe yönelik olarak Anthropic, saldırgan amaçlı veri çıkarımını tespit etmek için yeni sınıflandırıcılar ve modelin içsel akıl yürütme süreçlerinin yetkisiz eğitimler için çalınmasını önlemek amacıyla "korunmuş düşünce" (preserved thinking) sistemini içeren katmanlı savunmalar uygulamaya koydu.
Şirket ayrıca, güvenilir kullanıcı programları aracılığıyla yüksek riskli biyolojik ve siber yeteneklere erişimi kısıtlıyor.
Bu önlemler, modellerin yetkinliği arttıkça ve kalıcı tehdit aktörlerinin kötüye kullanım riski büyüdükçe, yapay zeka tedarik zincirini ve küresel altyapıyı korumayı hedefliyor.