Z.ai’nin GLM-5.3 Modeli ve Siber Güvenlik Testleri
Z.ai, açık kaynaklı GLM-5.3 modelinin yazılım açıklarını tespit etme yeteneklerini ölçen sınavlarda Anthropic’in erişimi kısıtlı Mythos 5 modeline yakın performans sergilediğini açıkladı. Şirketin verdiği puanlar bağımsız kaynaklarca doğrulanmamış olsa da, sonuçlar Çinli girişimin bu alandaki iddiasını güçlendiriyor.
Şirketin belirttiğine göre GLM-5.3, CyberGym testinde %84,5 skor alırken Anthropic’in Mythos 5 modeli %83,8 puan aldı. Buna karşın, açıkları sömürüye dönüştürme yeteneğini ölçen ExploitBench’te GLM-5.3 %54,4 ile Mythos 5’in %78,0’inin gerisinde kaldı.
Performans ve hız ölçümleri
Zamana bağlı değerlendirmelerde de farklar görüldü: GLM-5.3 iki saatte 105, altı saatte 130 saldırı geliştirme görevini tamamlayabildi; Mythos 5 aynı zaman dilimlerinde sırasıyla 181 ve 247 görev gerçekleştirdi. Anthropic, Mythos’u güvenlik korumaları kaldırılmış Claude Fable 5 olarak yalnızca denetimli kuruluşlara açıyor.
Şirket, GLM-5.3’ün halka açılmadan önce ek güvenlik katmanlarıyla güçlendirileceğini ve en hassas siber güvenlik fonksiyonlarının yalnızca doğrulanmış kullanıcılara sunulacağını belirtti. Z.ai, modele talepleri tarayan ve zararlı görevleri reddeden koruma mekanizmaları eklediğini söyledi.
Güvenlik endişeleri ve açık modele yaklaşım
Uzmanlar, bir model indirilebilip değiştirilebildiğinde veya harici araçlarla entegre edildiğinde bu tür güvenlik önlemlerinin uygulanmasının zorlaştığını vurguluyor. Z.ai ise bu hamleyi Mythos tarzı sınırlı erişim modeline bir meydan okuma olarak sundu: gelişmiş savunma araçlarının kapalı model sağlayıcılarının tekelinde kalmaması gerektiğini savunuyor ve açık kaynak geliştiricilere erişim sağlanmasının önemini öne çıkarıyor.
Bu amaçla şirket, seçili açık kaynak projelerini denetlemek, savunma amaçlı erişim sağlamak ve ZCode ürününe kod denetimi özellikleri eklemek için “Açık Kaynak Kalkanı” girişimini başlattığını duyurdu.
Modelin karakteri ve geçmiş bağlam
GLM-5.3, özel amaçlı bir güvenlik aracı olmayıp genel amaçlı kodlama modeli olarak konumlanıyor. Z.ai, modelin siber güvenlik yeteneklerini uzatılmış eğitim sonrası süreçler ve pekiştirmeli öğrenme ile geliştirdiğini açıkladı. Şirket, GLM-5.2 ile aynı temel mimariyi kullandığını ancak daha uzun ve çeşitli görev ortamlarında eğiterek performansı yükselttiğini söyledi.
Daha önce de Çinli başka firmalar benzer iddialarda bulunmuş; örneğin siber güvenlik şirketi 360, Tulongfeng adlı sistemle Mythos düzeyine ulaştığını ileri sürmüştü ancak bu iddialar da bağımsız olarak teyit edilmemişti.
Sonuç olarak, Z.ai’nin adımı, kapalı erişimli güçlü modellerin hakim olduğu alanda açık kaynak ve daha geniş erişim savunusunu güçlendirme çabası olarak okunuyor. Ancak modelin bazı sömürü yeteneklerinde hâlâ farklar bulunuyor ve bağımsız doğrulama eksikliği tartışmaları sürdürüyor.