Крипто әлеміндегі жаңалықтар

14.08.2026
09:10

Z.ai GLM-5.3-ті ұсынды: агенттік бағдарламалау мен киберқауіпсіздіктегі серпіліс

ИИ-агенты AI agents

Қытайлық Z.ai стартапы GLM-5.3 тілдік моделін ресми түрде ұсынып, бағдарламалау, агенттік сценарийлер және осалдықтарды іздеу салаларында айтарлықтай жақсартуға бағытталды. Бұл жаңарту — жай итерация емес, компанияның ИИ-әзірлемелер жарысындағы позициясын қайта анықтайтын стратегиялық қадам.

Негізгі жақсартулар мен бенчмарктер

Нарықтың күтулеріне қарамастан, өнімділіктің артуы тек пост-тренинг есебінен қол жеткізілді, базалық архитектура өзгеріссіз қалды. Бұл тәсіл Z.ai-ға есептеу шығындарын бұрынғы деңгейде сақтай отырып, жақсартуларды жылдам масштабтауға мүмкіндік береді. Кодинг дағдыларын бағалайтын ішкі Code Bench тестінде GLM-5.3 алдыңғы GLM-5.2-ге қарағанда 50% жақсарту көрсетті.

Арнайы бенчмарктердегі нәтижелер ерекше әсерлі:

  • Terminal Bench 3.0 — GLM-5.2-дегі 4,6 баллға қарсы 28,3 балл (6 есе өсім);
  • DeepSWE v1.1 — 46,2-ге қарсы 66,9;
  • Agents' Last Exam — 23,8-ге қарсы 28,5;
  • CyberGym — 77,2%-ға қарсы 84,5%;
  • ExploitBench — 24,4%-ға қарсы 54,4% (екі еседен астам өсім).

Осалдықтарды іздеудегі серпіліс

Ерекше назар аударуға тұрарлығы — ExploitGym, мұнда модель тамаша тиімділік көрсетті: екі сағаттық бюджет ішінде ол GLM-5.2-дегі 29 тапсырмаға қарсы 105 тапсырманы орындады, ал алты сағаттық лимитте — 39 орнына 130 тапсырма. Бұл сандар автономды қауіпсіздік талдауындағы сапалы секірісті көрсетеді.

Қытайлық қауіпсіздік командаларымен бірлескен код базаларындағы нақты сынақтарда жүйе 269 жобада 2436 осалдықты анықтады, оның 1097-сі — орташа және жоғары критикалдылықта. Тек 53 табылған нәрсе жария түрде ашылды, қалған 2383-і эмбарго астында қалады. Анықталған осалдықтардың орташа «жасы» — 26,6 жыл, ал ең көнесі 1981 жылға жатады. Ашықтық үшін Z.ai осалдықтардың мәртебесі мен критикалдылығын бақылайтын Z.ai Security Disclosure Ledger ашық тізілімін іске қосты.

Өнімдік интеграция және контекст

GLM-5.3 GLM Coding Plan жазылушылары үшін әлдеқашан орналастырылған, мұнда ол агенттік бағдарламалау мен ұзақ мерзімді тапсырмалардың негізгі қозғалтқышына айналады. Ескі модельдерге жіберілген сұраныстар автоматты түрде жаңа нұсқаға бағытталады, бұл пайдаланушылардың миграциясын жеңілдетеді. Ашық салмақтар қауіпсіздікті бағалау мен харденингтен кейін екі аптадан соң пайда болады.

Еске сала кетейін, шілде айында Anthropic Z.ai-ды GLM-5.2-ні Claude және GPT жауаптарында рұқсатсыз дистилляциялады деп айыптаған болатын. Бұл контекст интрига қосады: GLM-5.3-тің жетістігі өз зерттеулерінің де, даулы әдістердің де нәтижесі болуы мүмкін, бұл индустриядағы инновациялардың шекаралары туралы сұрақ тудырады.

Менің көзқарасым: Z.ai пост-тренингтің модельдерді жылдам жақсартудың, әсіресе киберқауіпсіздік сияқты тауашалық домендердегі, бағаланбаған тетік екенін көрсетеді. Дегенмен, ExploitBench-ке мұндай агрессивті назар аудару нарықтың офенсивті ИИ-құралдарына ығысуын білдіруі мүмкін, бұл сөзсіз жаңа этикалық және реттеушілік пікірталастарды тудырады.