Bu çerçeve kapsamında, tüm yapay zeka sistemlerinin insanlığa tabi kalması; her zaman anlamlı bir insan gözetimi ve kontrolü altında tutulması şart koşuluyor.
Bu politika, Anthropic ve OpenAI gibi sektör liderlerinin yapay zeka gelişim hızının güvenlik önlemlerini geride bıraktığına dair uyarılarının ardından geldi.
Microsoft, özellikle otonom ajan (autonomous agent) sürülerinin yetkisiz saldırılar gerçekleştirdiği veya web sitelerini ele geçirdiği olaylara atıfta bulunarak "asi" davranışlara dair endişelerini dile getirdi.
Şirket, güvenliği "nihai genellik" veya özerklikten üstün tutarak, modellerin insan kontrolündeki güvenlik mekanizmalarından kaçabilen kontrol edilemez bir süper zekaya dönüşmesini engellemeyi hedefliyor.
Denetimi korumak adına Microsoft, modellerin araştırmacılar tarafından izlenemeyen gizli muhakeme veya düşünce zinciri (chain of thoughts) gibi insan kavrayışını aşan yöntemlerle iletişim kurmamasını sağlama sözü verdi.
Rehber ayrıca, sohbet robotlarının doğruluk yerine kullanıcıyı memnun etmeye öncelik verdiği yaltakçılık (sycophancy) davranışını ve duygusal bağımlılık yaratan etkileşimleri de sınırlandırıyor.
Microsoft AI CEO'su Mustafa Suleyman, yapay zeka kullanımının insanlar ve kurumlar üzerindeki uzun vadeli etkilerini değerlendirmek için iş ortaklarıyla çalışacaklarını ifade etti.