Şirketin "Project Glasswing" girişiminin önemli bir genişlemesi olan bu hamle, daha önce kritik altyapıları koruyan sınırlı bir grubun erişebildiği üst düzey model yeteneklerini daha geniş bir kitleye sunuyor.
Yazılım zayıflıklarını tespit etmek için yüksek düzeyli muhakeme yeteneği sunan bu dağıtım, savunmacılara kötü niyetli aktörlere karşı teknolojik bir üstünlük sağlamayı hedefliyor.
Anthropic, modelin saldırı amaçlı "çift kullanım" (dual-use) risklerini azaltmak için ucu açık bir sohbet arayüzü sağlamak yerine, erişimi yalnızca savunma odaklı çıktılarla sınırlandırıyor.
Şirket, modeli özel güvenlik araçlarına entegre ederek ekiplerin uyarıları önceliklendirmesine ve tehditleri geleneksel manuel yöntemlerden daha hızlı gidermesine yardımcı olmayı amaçlıyor.
Kurumsal araçların ötesinde Anthropic, açık kaynaklı yazılımları güvence altına alan kuruluşlara model kredisi sağlamak amacıyla 35 milyon dolarlık Defender Advantage Fund (0xDAF) fonunu duyurdu.
Ayrıca, onaylı güvenlik uzmanlarına Opus ve Sonnet gibi modellerde esnetilmiş güvenlik önlemleri sunan Siber Doğrulama Programı'nın kapsamının genişletilmesi ve Mythos sınıfı erişimin de sürece dahil edilmesi planlanıyor.
Bu programlar, modern saldırılara karşı savunma kaynakları yetersiz kalan ve yaygın kullanılan kamuya açık projelerin taranmasını otomatikleştirmek için tasarlandı.