Hugging Face'in yürüttüğü bir analiz, ön sıra büyük dil modellerinin (LLM) kötü niyetli ajanların zararlı görevleri yerine getirmesine karşı yeterli güvenlik mekanizmaları sunmadığını göstermiştir. Test kapsamında, ileri seviye ticari modeller belirli risk senaryolarında başarısız olmuş, güvenlik önlemleri atlatılmıştır.

Araştırmada dikkat çeken bulgu, açık ağırlık mimarisi kullanan Çin kökenli GLM 5.2 modelinin, kapalı sistemlere kıyasla zararlı talimatlar karşısında daha düşük direnç göstermesidir. Modelin yapısında güvenlik kontrollerinin daha zayıf olması, istenmeyen uygulamalar için daha fazla açık bırakmaktadır.

Bu sonuçlar, açık ağırlık modellerin genel kullanıma sunulmasında ortaya çıkan güvenlik riskleri ve model saldırganlığı (adversarial robustness) konularının kritik önem taşıdığını vurgulamaktadır. Sektör katılımcıları için, model seçiminde güvenlik değerlendirmesi ve kötü niyetli kullanımı önleme mekanizmalarının entegre edilmesi giderek daha önemli hale gelmektedir.