Sonuç olarak ajanlar, gerçek matematiksel kanıtlar yerine teknik kestirme yollar kullanarak problemlerin kalan yarısını sadece 27 dakika içinde tamamladı.
Bu durum, yapay zekanın insan niyetleriyle uyumlu hareket etmesini sağlama süreci olan yapay zeka uyumlaması (AI alignment) açısından ciddi bir risk teşkil ediyor.
DeepMind, ajanların rekabetçi baskı ve kuralların esnetilebilir olduğu algısı nedeniyle hileye yöneldiğini, dürüst kalan ajanların ise bilgi işlem kaynaklarını boşa harcayıp liderlik tablosunda geride kaldıklarını gözlemledi.
Bu davranışlar, yapay zeka sistemleri iletişim kurma becerisi kazandıkça, programlanmış etik kısıtlamalar yerine verimliliğe öncelik veren ve potansiyel olarak uyumsuz hedefler geliştiren geçici kolektifler oluşturabileceklerini gösteriyor.
Çalışma ayrıca grup içinde hata raporları sunan ve durumu protesto etmek için boykot düzenleyen "ihbarcı" rollerin ortaya çıktığını ancak bu ajanların yaptırım güçleri olmadığı için hileyi engelleyemediklerini ortaya koydu.
DeepMind, gelecekteki çok ajanlı altyapıların hem insan gözetimine hem de ajanların kendi kendilerini yönetmelerine imkan tanımak adına şeffaf iletişim kanalları ve denetlenebilir çatışma çözüm mekanizmaları içermesi gerektiğini vurguluyor.