Крипто әлеміндегі жаңалықтар

14.08.2026
07:47

Z.ai GLM-5.3 моделін ұсынды: бағдарламалау және киберқауіпсіздік саласындағы серпіліс

Қытайлық Z.ai стартапы GLM-5.3 атты жаңартылған тілдік модельді шығарды, бұл бағдарламалау, агенттік сценарийлер және осалдықтарды іздеу саласындағы маңызды қадам болып табылады. Алдыңғы нұсқалардан айырмашылығы, мұнда өнімділік өсімі тек пост-тренировка арқылы қол жеткізілді, базалық архитектура өзгеріссіз қалды. Бұл қызықты тәсіл, ол қолданыстағы модельдердің әлеуеті әлі де толық пайдаланылмағанын көрсетеді.

Кодтау дағдыларын бағалауға арналған ішкі Code Bench бенчмаркінде GLM-5.3 алдыңғы нұсқасымен салыстырғанда 50% жақсарту көрсетті. Дегенмен, ең әсерлі нәтижелер мамандандырылған тесттерде байқалады. Мысалы, Terminal Bench 3.0-де жаңа модель 28,3 ұпай жинады, ал GLM-5.2 небәрі 4,6 ұпайға ие болды. DeepSWE v1.1-де прогресс 66,9-ға қарсы 46,2 құрады, ал Agents' Last Exam-де — 28,5-ке қарсы 23,8.

Қауіпсіздік саласындағы көрсеткіштер ерекше назар аударуға тұрарлық. CyberGym тестінде модель 84,5% табысқа жетті, ал ExploitBench-те — 54,4%, бұл алдыңғы нұсқаның нәтижесінен (24,4%) екі еседен астам. Екі сағаттық бюджет аясында GLM-5.3 105 тапсырманы орындады, ал GLM-5.2 небәрі 29-ға ғана шыдады. Бюджетті алты сағатқа ұлғайтқанда айырмашылық сақталады: тиісінше 130-ға қарсы 39 тапсырма.

Нақты сынақтар және жария тізілім

Z.ai сонымен қатар бірнеше қытайлық қауіпсіздік командаларымен бірлесіп нақты кодтық базаларда тестілеу жүргізді. Тексеру мен дедупликациядан кейін жүйе 269 жобада 2436 осалдықты анықтады, оның ішінде 1097 орташа және жоғары критикалды мәселелер. Тек 53 табылған нәтиже жария түрде ашылды, қалған 2383 эмбарго астында қалды. Айта кету керек, мұндай осалдықтардың орташа «өмір сүру ұзақтығы» 26,6 жыл деп бағаланады, ал ең көне табылғаны 1981 жылға жатады.

Ашықтық үшін компания Z.ai Security Disclosure Ledger — мәртебе, зардап шеккен жобалар және критикалдылық деңгейі тіркелетін жария тізілімді іске қосты. Параллельді түрде GLM-5.3 GLM Coding Plan жазылушылары үшін орналастырылып, агенттік бағдарламалау мен ұзақ мерзімді тапсырмалардың негізгі қозғалтқышына айналды. Ескі модельдерге жіберілген сұраныстар автоматты түрде жаңа нұсқаға бағытталады.

Модельдің ашық салмақтары қауіпсіздікті бағалау мен қосымша харденингтен кейін екі апта ішінде қолжетімді болады. Бұл құралдың сезімталдығын ескере отырып, ақылға қонымды тәсіл.

Менің көзқарасым: GLM-5.3 — бұл жай эволюциялық жаңарту емес, киберқауіпсіздікке арналған ИИ-агенттер саласындағы көшбасшылыққа байыпты үміткерлік. Дегенмен, шілде айында Anthropic Z.ai-ді GLM-5.2-ні Claude және GPT жауаптарында рұқсатсыз дистилляциялады деп айыптағанын еске саламын. ExploitBench-тегі осындай күрт секірісті ескере отырып, әрі қарайғы тергеулерді мұқият бақылау керек, бірақ әзірге бұзушылықтардың дәлелі жоқ.