OpenAI компаниясының бұрынғы техникалық директоры Мира Мурати ақыры өзінің жаңа жобасы — Thinking Machines Lab жоспарын ашты. Inkling деп аталатын алғашқы жария модель сынақтан өткізу және дәл баптау үшін қолжетімді. Бұл жай ғана кезекті тілдік ассистент емес, мәтін, кескін және аудио туралы бір уақытта ой қорыта алатын мультимодальды AI бағытындағы маңызды қадам.
Inkling архитектурасы MoE (Mixture of Experts) қағидатына негізделген: әрбір сұраныс кезінде желінің тек бір бөлігі ғана іске қосылады, бұл талдау тереңдігін жоғалтпай, жоғары жылдамдықты инференсты қамтамасыз етеді. Параметрлердің жалпы пулы 975 миллиардты құрайды, оның 41 миллиарды белсенді. Контексттік терезе — әсерлі 1 миллион токен. Модель нөлден бастап 45 триллион токенде, соның ішінде мәтін, кескін, аудио және бейнеде оқытылды.
Дегенмен, мультимодальды қабілеттерге қарамастан, Inkling әзірге тек мәтіндік жауаптарды — код, құрылымдалған деректер және аналитикалық қорытындыларды ғана жасайтынын атап өткен жөн. Бірақ қызықты ерекшелігі де бар: пайдаланушы басқарылатын ойлау деңгейін пайдалана отырып, жылдамдық пен сапа арасындағы тепе-теңдікті қолмен реттей алады. Бұл ашық модельдерде сирек кездесетін икемділікті береді.
Inkling өзінің күшті жақтарын қайда көрсетеді
Менің ойымша, модель ең әсерлі нәтижелерді агенттік тапсырмаларда көрсетеді. Model Context Protocol көмегімен тапсырмаларды орындауды бағалайтын MCP Atlas тестінде Inkling 74,1% жинады — бұл ашық модельдер арасындағы басты батыс бәсекелесі Nvidia Nemotron 3 Ultra-дан 30 пунктке жоғары. GitHub-тағы қателерді автономды түзетуді тексеретін SWE-Bench Verified тестінде де Inkling сенімді түрде көш бастап тұр: 77,6% Nemotron-ның 70,7%-ына қарсы.
Шамадан тыс блоктаусыз зиянды сұраныстарды дұрыс өңдеуді бағалайтын FORTRESS Adversarial тестінде модель 78% алды. Бұл оны қазіргі уақытта батыс әзірлемелері арасындағы ең қуатты ашық модельге айналдырады. Алайда, күтілгендей, Inkling әзірге қытайлық алыптардан қалып отыр. Нақты ортада автономды кодтауды тексеретін Terminal Bench 2.1 тестінде Inkling 63,8% жинады, ал Z.ai GLM 5.2 82,7%, Moonshot AI компаниясының жақында шығарылған Kimi K3 моделі 88,3% көрсетті. Kimi K3 сонымен қатар PhD деңгейіндегі ғылыми ойлау тестінде — Humanity's Last Exam-да көш бастап тұр.
Thinking Machines компаниясы Inkling-ті басқа тапсырмалардағы артықшылық үшін бір тапсырмаларды құрбан етпейтін «әмбебап» модель ретінде ұсынады. Бәс кастомизацияға жасалды: компания бизнеске әмбебап «швейцариялық пышақ» емес, нақты тапсырмаға арналған икемді модель маңыздырақ деп есептейді.
Менің сараптамалық көзқарасым: Inkling — бұл маңызды өтініш, бірақ ол анық баптау мүмкіндігі маңызды болатын тар корпоративтік сценарийлерге бағытталған. Модель жалпы тестілерде қытайлық аналогтардан қалып отырғанымен, оның күші агенттік және кодтық тапсырмаларда. Егер Thinking Machines компаниясы кастомизацияны масштабтай алса және ғылыми тестілердегі нәтижелерді жақсарта алса, Inkling DeepSeek және GLM үшін нақты бәсекелес бола алады. Бірақ әзірге бұл тек алғашқы қадам.