Сеулда өткен ICML 2026 конференциясында жасанды интеллект жүйелеріне шабуыл жасаудың түбегейлі жаңа әдістемесі ұсынылды. Оның мәні — деректерді бұзу немесе рұқсатсыз кіру емес, модельдің жұмысын әдейі баяулатып, оны мүлдем жарамсыз күйге жеткізу. Чжэцзян университеті мен Alibaba зерттеушілері пайымдаушы ЖИ-дің күшті жағын олардың Ахиллес өкшесіне айналдыруға болатынын көрсетті.
Шабуыл механикасы: ЖИ-ді «шексіз ойлануға» қалай мәжбүрлеуге болады
Стандартты үлкен тілдік модельдерден (LLM) айырмашылығы, пайымдаушы модельдер (reasoning models) күрделі тапсырмаларды дәйекті логикалық қадамдарға бөледі. Бұл ерекшелік оларды көп сатылы талдау үшін таптырмас етеді, бірақ сонымен бірге осалдық тудырады. Толық емес немесе қайшылықты деректермен жұмыс істегенде мұндай модельдер шамадан тыс «ойлануға» бейім, тым ұзын пайымдау тізбектерін жасайды.
Әзірленген әдіс осы мінез-құлықты мақсатты түрде қоздыру үшін генетикалық алгоритмді пайдаланады. Алгоритм тапсырма шарттарын араластырады, негізгі алғышарттарды жояды және қосымшаларын қосады, ең ұзын жауап тудыратын нұсқаларды іріктейді. Нәтижелер әсерлі: MATH тест жиынтығында пайымдау тізбектерінің ұзындығы 26,1 есеге артты. Ең осалдары DeepSeek-R1, Qwen3-Thinking, GPT-o3 және Gemini 2.5 Flash болды.
Өте маңыздысы, бір шағын модель үшін жасалған сұраныстар ірі коммерциялық жобаларды қоса алғанда, басқа жүйелерге қарсы да тиімді болды. Бұл айтарлықтай шығынсыз жабық сервистерге шабуыл жасау мүмкіндігін ашады.
DeFi және агенттік жүйелер үшін тәуекелдер
Пайымдаушы модельдердің агенттік ЖИ жүйелерінде, соның ішінде сауда боттарында, смарт-келісімшарттарды аудиттеу құралдарында және орталықсыздандырылған инфрақұрылымда таралуы ерекше алаңдаушылық тудырады. DeFi-де ЖИ негізіндегі цифрлық көмекшілер адамның қатысуынсыз нақты қаражатты басқарады. Әдейі туындаған логикадағы ақау тікелей операциялық тәуекелді тудырады.
Бұл жұмыс 2025 жылдың ақпан айында анықталған белгілі «шамадан тыс ойлану» мәселесін растайды. 4018 агенттік траекторияны талдау үш негізгі үлгіні көрсетті: «талдау салдануы» (модель тапсырманы орындаудың орнына пайымдауды жалғастырады), «болжауға келмейтін әрекеттер» (қатеден кейін бірнеше әрекетті бір уақытта орындауға тырысу) және «мерзімінен бұрын аяқтау» (нәтижені тексермей тапсырманы тоқтату).
Менің сараптамалық бағам: Шабуылдардың бұл түрі жай академиялық қызық емес, жауап беру уақыты маңызды инфрақұрылым үшін нақты қауіп болып табылады. Жетекші ЖИ компанияларының одан әрі дамуы есептеу қуаттарының қолжетімділігіне көбірек тәуелді болғандықтан, мұндай DoS-шабуылдар тұтас экожүйелердің жұмысын бұзудың арзан және тиімді құралына айналуы мүмкін. DeFi жобаларының инвесторлары мен әзірлеушілері осы жаңа шабуыл бетін ескере отырып, өздерінің қауіпсіздік хаттамаларын дереу қайта қарауы керек.