Hassas verilerin ele geçirilmesine neden olan ana açık yamalanmış olsa da ekip, bu tekniği kullanarak Moonshot AI’ın Kimi K3 modelinin Claude ve GPT ile şaşırtıcı derecede benzer muhakeme kalıpları ürettiğini ortaya koydu.
Bu keşif, bir geliştiricinin yeni bir yapay zeka modelini daha gelişmiş bir modelin çıktılarıyla eğiterek yeteneklerini hızla kopyalaması işlemi olan "damıtma" (distillation) konusundaki sektörel tartışmalara yeni kanıtlar sunuyor.
ABD'li teknoloji şirketleri, daha önce Çinli rakiplerini özgün araştırma ve geliştirme maliyetlerinden kaçınarak stratejik avantaj elde etmek için bu yöntemi kullanmakla suçlamıştı.
Bulgular kopyalamaya dair kesin bir kanıt sunmasa da muhakeme süreçlerindeki yüksek benzerlik, ABD merkezli modellerin tescilli mantığının Çinli açık ağırlıklı sistemlere güç vermek için kullanılıyor olabileceğine işaret ediyor.
Söz konusu güvenlik açığı, yapay zeka sağlayıcılarının hesaplama yükünü hafifletmek için kullanıcının cihazına şifrelenmiş muhakeme verileri göndermesinden kaynaklanıyor.
Daha küçük model varyantları genellikle büyük modellerle aynı şifre çözme anahtarlarını paylaştığı ancak aynı sıkı güvenlik uyumuna sahip olmadığı için, gizli tutulması gereken bu "düşünceleri" ifşa edecek şekilde manipüle edilebiliyor.
Anthropic bu konuda önlemler aldığını doğrularken, uzmanlar bu durumun tamamen engellenmesi için yapay zeka yazılım arayüzlerinin işleyişinde temel bir tasarım değişikliği yapılması gerektiğini belirtiyor.