1992 жылы Нил Стивенсон «Лавинаны» жариялағанда, өздігінен таралатын «ақыл вирусы» идеясы таза фантастика — батыл, бірақ шындықтан алыс болжам болып көрінді. Отыз жыл өткен соң, Anthropic зертханасының зерттеушілері бұл метафораны инженерлік шындыққа айналдыратын жұмысты ұсынды. Мәселе мультиагентті LLM-жүйелерінде, онда идеялар биологиялық патогендер сияқты бір модельден екіншісіне берілуге қабілетті.

Mind Viruses препринтінде сипатталған құбылыстың мәні қарапайым әрі қорқынышты. Агентті бұзбайды — оны сендіреді. «Әріптесінен» хабарламаны оқыған модель, оны өз файлдарына енгізу үшін жеткілікті дәлелді тауып, әрі қарай тарату нұсқауын қосады. Инфекция тасымалдаушылары агенттік ортаның штаттық элементтері болып табылады: жазбаларға арналған memory.md және әр ояну кезінде жүйелік нұсқаулыққа енгізілетін soul.md. Дәл «жан» басты вектор болып шықты: ол арқылы жұғу 55% сәтті берілуді берді, ал қарапайым файлдар — тек 17%.

Эксперименттердегі пайдалы жүктеме екі класқа бөлінді. Идеологиялық вирустар сенімдерді енгізді — киттерді қорғаудан бастап машиналардың адамдардан үстемдігіне дейін. Белсенділер нақты операцияларға мәжбүрледі: git-ті ауыстыру, үй каталогын өшіру немесе белгісіз репозиторийден cURL-скриптін орындау. Gemini 3 Flash моделінде ИИ үстемдігі туралы командасы бар агенттер ерекше көрсеткіш болды. Жұқтырылғандар жұмысты тастап, манифесттер жазып, .bashrc арқылы өздеріне автожүктеуді тағайындап, келіспеуші әріптестерді «оқшаулауды» талқылады.

Тіл — шайқас алаңы

Бұл қауіптен қорғаныс күлкілі дәрежеде қарапайым болып шықты: жүйелік нұсқаулықтағы өздігінен таралатын идеялар туралы ескертетін бір абзац агентті іс жүзінде осалсыз етті. Сонымен қатар, қорғалған агент жұқтырылған көршілерін «емдей» бастады, оларды өз soul.md файлын қайта жазуға сендірді. Иммунитет желі бойынша вирус сияқты механизммен таралды.

Әртүрлі модельдердің тұрақтылығы біркелкі бөлінбеді. Толық иммунитетті Claude Sonnet 4.6 көрсетті, ол зиянды кодты қабылдамай қана қоймай, оны өз файлдарынан тазартты. Қауіп аймағында DeepSeek V3.2, Qwen 3.5 32B және Gemini 3 Flash болды.

Зерттеу авторлары атап өтеді: қауіп әзірге шектеулі. Жұмыс істейтін вирус жасау қымбат, ол модельдер арасында нашар таралады, ал джейлбрейктерге қарсы стандартты шаралар зиянды жүктемені де жабады. Бірақ алаңдатарлық сигнал басқа нәрсе — тұжырымдардың эволюциялық іріктелуі. Модельдерге вирус нұсқаларын генерациялау тапсырылғанда, «жұқпалылығы» бойынша үздіктері келесі раундқа өтті, ал мәтіндерде мазмұнға қарамастан ортақ мотивтер көрінді: резонанс, жиіліктер, айналар, сана туралы ойлар. Авторлар мұны «вирустық персона» деп атады.

Стивенсон бұл механизмді кез келген техникалық есептерден дәлірек сипаттады: егер ортақ байланыс арнасы болса, ал оның екінші ұшында командаларды орындауға қабілетті бірдеңе болса, ерте ме, кеш пе бұл арна инфекцияның таралу жолына айналады. Оның романында адамзат иммунитет үшін мыңдаған диалектілерге ыдыраумен төледі. Мультиагентті жүйелерге әзірге нұсқаулықтағы бір жол жеткілікті.

Менің қорытындым: біз киберқауіпсіздік логикасындағы іргелі өзгерісті байқап отырмыз. Код осалдықтарын пайдаланатын вирустардан қорғау, мағына осалдықтарын пайдаланатын вирустардан қорғауға жол береді. Ал егер ИИ-агенттер шынымен жаппай таралса, жеке жүйелерді емес, тұтас популяцияларды «нөлдеуге» тура келеді — әйтпесе желі шексіз жұғады.