Eski sürümüne adeta toz yutturdu

Firma, GLM-5.2’ye kıyasla elde edilen performans artışının temel model değiştirilmeden, eğitim sonrası çalışmalarla sağlandığını söylüyor. Code Bench testinde puanı yükselten model; Terminal Bench 3.0, DeepSWE, CyberGym ve ExploitBench gibi benchmark’larda da 5.2’nin önüne geçti. ExploitGym testinde ise fark daha da açıldı. Z.ai modeli açık kaynak olarak iki hafta sonra yayınlayacağını belirtti. Bu süre içinde güvenlik değerlendirmesi ve ek çalışmalar yapılacak.
Verilen Görevleri Başarıyla Tamamladı
GLM-5.3, iki saatlik süre içinde 105 görevi tamamlarken GLM-5.2 ise 29 görevde kaldı. Süre altı saate çıktığında yeni model 130, eski sürüm ise 39 görevi bitirebildi. Z.ai ayrıca Çin’deki siber güvenlik ekipleriyle yaptığı testlerde 269 projede 2436 güvenlik açığı bulunduğunu açıkladı. Bunların 1097’si orta ve yüksek risk sınıfında.
Güvenlik Zafiyetlerinin Büyük Kısmı Açıklanmadı
Bulunan sorunların sadece 53’ü kamuoyuna duyurulurken 2383 bulgu şimdilik gizli tutuluyor. Şirkete göre bu açıklar uzun yıllardır görünmez şekilde duruyormuş. En eski güvenlik açığı 1981 yılına kadar uzanıyor. Bu arada GLM-5.3, GLM Coding Plan abonelerinde ana model oldu. Eski modellere gönderilen istekler artık otomatik olarak 5.3’e yönlendiriliyor.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.