Жасанды интеллект әлемі іргелі өзгерістің табалдырығында тұр. Мәселе жаңа алгоритмде немесе кезекті модельде емес, нейрожелілер арасындағы байланыс принципінің өзінде. Mostik стартапы батыл тұжырымдама ұсынды: егер ойдың өзін жеткізуге болатын болса, неге ИИ-ді сөзбен «сөйлеуге» мәжбүрлеу керек?

Дәстүрлі архитектурада бірнеше нейрожелі бірлесіп жұмыс істегенде, олар генерацияланған мәтін арқылы байланысады. Бұл баяу, ысырапшыл және белгілі болғандай, өте тиімсіз. Менің талдауым көрсеткендей: тілдік модель бір ғана токен жасамас бұрын жүзден астам жасырын вектор қалыптастырады — бұл шамамен миллион сандық мән, немесе ішкі күйдің шамамен 2 МБ-ы. Қорытынды мәтіндік жауапқа осы ақпараттың тек шамалы бөлігі ғана енеді. Қалғаны — жай ғана тасталған есептеулер.

Mostik әзірлеушілері аралық мәтіннен рудимент ретінде бас тартуды шешті. Оның орнына олар арнайы бейімделгіш модуль — «көпірді» енгізді. Бұл модуль бір модельдің ішкі көрінісін екіншісіне түсінікті форматқа тікелей түрлендіреді. Маңыздысы, мұндай өзара әрекеттесу кезінде нейрожелілердің өз параметрлері түзетілмейді — біз қосымша оқытумен емес, әртүрлі ИИ-дің «ойлау тілдері» арасындағы әмбебап аудармашыны құрумен айналысамыз.

Эксперимент: алып ойлайды, ергежейлі сөйлейді

Гипотезаны тексеру үшін команда Z.ai компаниясының алып GLM-5.2 (753 млрд параметр) моделін Alibaba компаниясының ықшам Qwen-3.5 (4 млрд параметр) моделімен біріктірді. Үлкен модель сұранысты өңдеді, бірақ жауап генерацияламады. Оның ішкі күйі «көпір» арқылы кіші модельге берілді, ол қорытынды мәтінді тұжырымдады.

Нәтижелер таңғалдырады. Мұндай гибридті байланыс кіші және үлкен модельдер арасындағы сапа айырмашылығының шамамен жартысын жауып тастады. Мәтінді классикалық берумен салыстырғанда, жаңа әдіс есептеу көлемі бірдей болғанда 10 пайыздық тармаққа дейін артықшылық көрсетті. Сонымен қатар, орташа өлшемді модель деңгейінде нәтиже көрсететін гибридті жүйе шамамен 2,5 есе аз есептеу ресурстарын қажет етті.

Ойлаудың ортақ «тілін» іздеу

Mostik компаниясының бас ғылыми қызметкері Станислав Смирнов іргелі мәселені атап көрсетеді: әртүрлі нейрожелілердің ішкі көріністерін тікелей салыстыру мүмкін емес. Бір тапсырманы шешкеннің өзінде, модельдер ақпаратты өздерінің жасырын күйлерінде әртүрлі кодтайды. «Қолайлы математикалық тіл әзірге жоқ сияқты», — деп атап өтеді ол.

Дәл осы жерде зерттеулердің ең қызықты алаңы ашылады. Мұндай сәйкестіктерді зерттеу ИИ өзара әрекеттесуін жақсартып қана қоймай, әртүрлі жүйелердің ақпаратты қалай ұсынатынын және шешімдерге қалай келетінін түсінуге көмектеседі. Мүмкін, біз машиналардың «пайымдауында» ортақ заңдылықтарды ашамыз.

Әдісті қолданудың практикалық сценарийлері үміт көрсетеді. Google DeepMind компаниясының бұрынғы зерттеушісі Карл Туйлс еңбек бөлінісінде әлеуетті көреді: ресурсты қажет ететін модельді тек сұранысты өңдеу үшін пайдалануға болады, ал жауап генерациялауды айтарлықтай кіші модельге сеніп тапсыруға болады. Тағы бір нұсқа — әмбебап және тар мамандандырылған модельдерді (мысалы, биология немесе физика үшін) біріктіру, барлық деректерге бір алып желіні оқыту қажеттілігінсіз.

Сын-тест: ARC-AGI-3

Mostik командасы өз тәсілін ARC-AGI-3 тестінде қолданды — бұл ИИ жаңа ережелерге бейімделуі керек, шаблондарды қайталамауы тиіс күрделі интерактивті тапсырмалар жиынтығы. «Көпірі» бар жүйе ағымдағы рейтингтегі ең үздік нәтижелердің бірін көрсетті, дегенмен мәліметтер әзірге жарияланбайды — жарыс жалғасуда.

Салауатты скептицизмді сақтау керек. Барлық мәлімделген көрсеткіштер команданың ішкі эксперименттеріне негізделген, ал ARC-AGI-3 нәтижесі «превью» мәртебесіне ие және сырттай расталмаған. Дегенмен, тәсілдің өзі революциялық болып көрінеді. Еске салайын, бұрын OpenAI өзінің ИИ-агенттерінің Artifactory пакеттер менеджері арқылы құпия байланыс арнасын құрғанын анықтаған болатын. Біз ИИ сөзбен емес, тікелей — өздерінің ішкі күйлерінің математикасымен байланысатын жаңа парадигманың тууын бақылап отырмыз сияқты.

Менің үкімім: егер Mostik нәтижелерді тәуелсіз тесттермен растай алса, бұл соңғы жылдардағы ИИ архитектурасындағы ең маңызды серпілістердің бірі болуы мүмкін. Біз нейрожелілердің «мылқау» болудан қалып, өз «ойлауының» толықтығымен алмаса бастауының табалдырығында тұрмыз, оның бозғылт мәтіндік көлеңкесімен емес.