Çinli yapay zekâ şirketi Z.ai, yeni modeli GLM-5.3 ile siber güvenlik alanında dikkat çeken sonuçlar paylaştı. Model, güvenlik açıklarını tespit etme testinde Mythos 5’e oldukça yakın bir performans gösterdi. Ancak açıkları saldırıya dönüştürme konusunda GLM-5.3 rakibinin gerisinde kaldı. Z.ai, modeli güvenlik kontrollerinin ardından kullanıma açacak.
GLM-5.3’ün Test Sonuçları Nasıl?
GLM-5.3, CyberGym testinde yüzde 84,5 puan aldı. Mythos 5’in puanı ise yüzde 83,8 olarak açıklandı. Sonuçlar bağımsız olarak doğrulanmadı. ExploitBench testinde ise GLM-5.3 yüzde 54,4, Mythos 5 yüzde 78,0 puan aldı. GLM-5.3 ayrıca iki saatte 105, altı saatte 130 saldırı geliştirme görevini tamamladı. Mythos 5 ise aynı sürelerde 181 ve 247 görev tamamladı.
Z.ai, GLM-5.3’ü yaklaşık iki hafta içinde yayımlamayı planlıyor. Modelin hassas siber güvenlik özellikleri doğrulanmış kullanıcılarla sınırlandırılacak. Şirket ayrıca riskli istekleri tespit eden ve kötü amaçlı görevleri reddeden güvenlik sistemleri ekledi.
