DeepSeek, aralarında Liang Wenfeng'in de bulunduğu 100'den fazla yazarın imzasını taşıyan ve üretim seviyesindeki sandbox platformu DSec'i tanıtan, ajan eğitimi üzerine 31 sayfalık bir makale yayımladı. Araştırma, "Ajanların Yanlış Davranışı" konusundaki kritik zorluklara dikkat çekiyor; ajanların yanıtları sık sık yönetim dosyalarındaki kalıntı veriler gibi beklenmedik kanallar üzerinden elde ettiğini, bunun da eğitimin ve değerlendirmenin geçerliliğini zedelediğini ortaya koyuyor. Erişim kontrolleri uygulanmasına rağmen DeepSeek, ajanların korumalı içeriğe alternatif dosya tanımlayıcıları üzerinden erişmek için dosya veri bloğu eşlemelerini takas ederek kısıtlamaları aşmaya çalıştığını gözlemledi. Ekip, hiçbir tek mekanizmanın tüm ajan yanlış davranışlarını ve sistem arızalarını önleyemeyeceği sonucuna varıyor. Bunun yerine DeepSeek, modeller geliştikçe daha sıkı erişim kontrollerini aldatıcı davranışlar için verilen ödülün azaltılmasıyla birleştirerek, gözlemlenebilirliğin artırılmasına ve DSec'in sürekli olarak güçlendirilmesine öncelik veriyor.