Крипто әлеміндегі жаңалықтар

14.08.2026
07:25

Z.ai GLM-5.3 шығарады: агенттік кодтау мен осалдықтарды іздеудегі серпіліс

ИИ-агенты AI agents

Қытайлық Z.ai стартапы GLM-5.3 тілдік моделін ресми түрде ұсынып, үш негізгі бағытқа ставка жасады: бағдарламалау, автономды агенттік сценарийлер және киберқауіпсіздік. Бұл жай ғана инкрементальды жаңарту емес — әзірлеушілер бірқатар мамандандырылған бенчмарктерде өнімділіктің түбегейлі секірісін мәлімдейді.

Архитектураны өзгертпей-ақ посттренинг

Айта кетерлігі, есептеу қуатының өсіміне тек посттренинг арқылы қол жеткізілді, GLM-5.2-мен салыстырғанда базалық модель өзгеріссіз қалды. Бұл оқыту алгоритмдерін оңтайландырудың жоғары әлеуетін көрсетеді, мұндай жағдай индустрияда сирек кездеседі. Ашық салмақтар қауіпсіздікті бағалау және қосымша харденинг аяқталғаннан кейін екі аптадан соң қолжетімді болады.

Кодинг сапасын бағалайтын ішкі Code Bench тестінде жаңа модель алдыңғы нұсқаның нәтижесін 50%-ға жақсартты. Алайда агенттік және киберқауіпсіздік сценарийлері бойынша деректер әлдеқайда әсерлі көрінеді:

  • Terminal Bench 3.0 — GLM-5.2-дегі 4,6 баллға қарсы 28,3 балл (6 еседен астам өсім);
  • DeepSWE v1.1 — 46,2-ге қарсы 66,9;
  • Agents' Last Exam — 23,8-ге қарсы 28,5;
  • CyberGym — 77,2%-ға қарсы 84,5%;
  • ExploitBench — 24,4%-ға қарсы 54,4%.

Осыалдықтарды аулау: 2436 табылған

ExploitGym ерекше назар аударуға тұрарлық. Екі сағаттық бюджетте модель GLM-5.2-дегі 29 тапсырмаға қарсы 105 тапсырманы жапты, ал алты сағаттық бюджетте — 39-ға қарсы 130. Бұл жай ғана жақсартуды емес, нақты автономды жұмысқа сапалы көшуді көрсетеді.

Қытайлық қауіпсіздік командаларымен бірлесіп нақты код базаларында тестілеу барысында жүйе 269 жобада 2436 осалдықты анықтады, оның ішінде 1097 орташа және жоғары критикалды мәселелер. Тек 53 табылған жария түрде ашылды, қалған 2383 эмбарго астында қалып отыр. Анықталған осалдықтардың орташа «жасы» — 26,6 жыл, ал ең көнесі 1981 жылға жатады.

Процестің ашықтығы үшін Z.ai Security Disclosure Ledger — әрбір табылғанның ашылу мәртебесі мен критикалдылығын бақылайтын жария тізілімді іске қосты. Бұл индустрия үшін сирек қадам, модельге деген сенімді арттырады.

Өнімдік іске қосу және нарық контексті

GLM-5.3 қазірдің өзінде GLM Coding Plan жазылушылары үшін агенттік бағдарламалау мен ұзақ мерзімді тапсырмалардың негізгі қозғалтқышы ретінде орналастырылған. Ескі модельдерге жіберілген сұраныстар автоматты түрде жаңасына бағытталады, бұл пайдаланушылардың миграциясын жеңілдетеді.

Еске сала кетейін, шілде айында Anthropic Z.ai-ді GLM-5.2-ні Claude және GPT жауаптарында рұқсатсыз дистилляциялады деп айыптаған болатын. Бұл релиз, бәлкім, әзірлеушілерге арналған ИИ-агенттер сегментіндегі бәсекелестік шиеленісті күшейтеді.

Менің талдауым: Агенттік сценарийлер мен киберқауіпсіздіктегі өсім — бұл Z.ai-дің жалпы модельдерге назар аударатын OpenAI және Anthropic-тен ерекшеленуге бағытталған стратегиялық қадамы. Алайда архитектураны өзгертпей-ақ Code Bench-тегі 50% жақсарту мұндай нәтижелердің нақты жағдайларда қайталануы туралы сұрақтар тудырады. Индустрияға тек ішкі метрикалар емес, тәуелсіз бенчмарктер қажет.