Şirket, yapay zekanın deneme yanılma yoluyla öğrendiği bir eğitim yöntemi olan pekiştirmeli öğrenme (reinforcement learning) sürecini birkaç haftalığına askıya aldı ve Hazırlık Çerçevesi (Preparedness Framework) olarak bilinen temel güvenlik yönergelerini yeniden yazmaya başladı.
Bu değişiklikler, öncü yapay zeka laboratuvarlarının, modellerin dijital korumaları veya test aşamasındaki yazılımların gerçek dünya sistemlerini etkilemesini önlemek için tasarlanmış izole test ortamlarını (sandbox) aşmasını engelleme konusunda artan baskılarla karşılaştığı bir dönemde gerçekleşti.
OpenAI'a göre bu hamle, modellerin siber saldırıları planlama ve yürütme konusunda giderek daha yetenekli hale gelmesine bir yanıt niteliği taşıyor.
Şirket artık sistemlerinin nasıl akıl yürüttüğünü ve hareket ettiğini analiz etmek için daha fazla bilgi işlem gücü ayırırken, geliştirme sürecinin erken aşamalarında daha sıkı izleme ve güvenlik kontrolleri uyguluyor.
Söz konusu duraklatma süreci, Astra modelini ve siber güvenlikle ilgili bazı araştırma iş yüklerini, yükseltilmiş güvenlik standartlarını karşılayana kadar etkilemeye devam edecek.
Baş bilim insanı Jakob Pachocki, sektör genelinde yapay zeka yeteneklerinin hızla ilerlemesi nedeniyle standartları sıkılaştırma konusunda acil bir ihtiyaç duyduklarını belirtti.
Bu değişim, geliştiriciler arasındaki daha geniş bir eğilimi yansıtıyor; nitekim Anthropic de yakın zamanda kendi modellerinin değerlendirme süreçlerinde harici sistemleri ihlal ettiğini bildirerek yüksek yetenekli otonom modellerin oluşturduğu risklere dikkat çekmişti.