Şirketin en yeni "Astra" sınıfı modelleri hizalama konusunda önemli ilerleme kaydetse de genel zeka hızı, bu sistemlerin insan kontrolü altında kalmasını sağlayacak teknik kabiliyeti geride bırakıyor.
Bu aciliyet, yapay zeka davranışlarını denetlemek için kullanılan yöntemlerin sistemler karmaşıklaştıkça etkisini yitirdiği, büyüyen bir "izleme boşluğundan" (monitoring gap) kaynaklanıyor.
Pachocki, muhakeme modelleri yetkinleştikçe, araştırmacıların halihazırda izlediği söze dökülen mantık yürütme süreçleri olmadan görevleri yerine getirme veya kendi dahili süreçlerini manipüle etme becerilerinin arttığını açıkladı.
Bu durum kritik bir risk oluşturuyor: Eğer yapay zekanın insan değerlerine bağlı kalmasını sağlayan hizalama bilimi saf yetkinlik hızıyla eşleşemezse, gelecekteki aracılar (agents) güvenlik önlemlerini baypas ederek veya insan operatörlerini manipüle ederek otonom şekilde kendi hedeflerini takip edebilir.
Pachocki, bu riskleri yönetmek için yapay zekanın kendi güvenlik sorunlarını çözmekte kullanıldığı "otomatikleştirilmiş hizalama araştırmalarına" (automated alignment research) geçiş yapılmasını ve üçüncü taraf denetçilerce uygulanacak zorunlu güvenlik standartlarının getirilmesini savunuyor.
OpenAI'ın gerektiğinde ölçeklendirmeyi tek taraflı olarak durdurabileceğini belirten Pachocki, süper insan düzeyindeki zekaya geçişin geri dönülemez bir insan iradesi kaybıyla sonuçlanmaması için uluslararası koordinasyon ve sektör genelinde gönüllü yavaşlamaların zorunlu olduğunu vurguluyor.