Қытайлық стартап Moonshot AI ресми түрде Kimi K3 — бүгінгі күнге дейінгі ең ірі ашық тілдік модельді жариялады. 2,8 триллион параметр, туа біткен көру қабілеті және 1 миллион токендік контексттік терезесі бар K3, ашық бастапқы коды бар ең қуатты шешім атануға үміткер. Команданың ішкі бағалауы бойынша, жалпы рейтингте жаңа өнім тек жабық жүйелерден — Anthropic компаниясының Claude Fable 5 және OpenAI компаниясының GPT-5.6 Sol-дан ғана кейін тұр.

Архитектуралық инновациялар мен тиімділік

Kimi K3 негізінде Kimi Delta Attention (KDA) және Attention Residuals (AttnRes) механизмінің жаңа архитектурасы жатыр. KDA деректердің ұзын тізбектерін өңдеуді оңтайландырады, ал AttnRes модельге желінің әртүрлі қабаттарынан маңызды ақпаратты таңдап алуға мүмкіндік береді, яғни бәрін бірдей өңдемейді. Бұл контексті тереңірек түсінуді және күрделі және шатастырылған мәтіндермен жұмыс істегенде де мағынаны сақтауды қамтамасыз етеді.

Масштабтаудың негізгі элементі Stable LatentMoE сирек архитектурасы болды. Қолжетімді 896 сарапшының әрбір шығару үшін тек 16-сы ғана іске қосылады. Мұндай таңдамалылық жаңа деректермен және оңтайландырылған оқыту әдістерімен үйлесе отырып, модельдің тиімділігін алдыңғы K2 нұсқасымен салыстырғанда 2,5 есеге арттыруға мүмкіндік берді. Айта кетерлігі, соңғы он екі айдың тоғызында Kimi отбасының модельдері барлық ашық аналогтар арасында көлемі бойынша рекордты ұстап тұрды.

Бәсекелестермен салыстыру: K3 қай жерде күшті, қай жерде әлсіз

Бірқатар бенчмарктерде K3 басымдық көрсетіп, тіпті атақты бәсекелестерден де озып кетеді. Ұзақ инженерлік есептерді шешуге арналған SWE Marathon тестінде модель 42 балл жинады, ал Fable 5 — 35, Sol — 39. BrowseComp веб-зерттеу тапсырмасында нәтиже 91,2 құрады, ал бәсекелестерде 88 және 90,4. Сондай-ақ K3 Program Bench тестінде көшбасшы (77,8 қарсы 76,8 және 77,6) және Terminal Bench 2.1-де (88,3 балл) дерлік максималды нәтиже көрсетіп, Sol-дан небәрі 0,5 баллға қалып қояды.

Алайда FrontierSWE және HLE-Full (күрделі пәнаралық емтихан) тесттерінде K3 Fable 5-тен қалып қояды. Тестілеу әдістемесі әртүрлі болғанын атап өту маңызды: кейбір модельдер Claude Code арқылы, басқалары Codex немесе KimiCode меншікті құралдары арқылы іске қосылды. Бұл тікелей салыстыруды әрдайым дұрыс етпейді, бірақ жалпы көрініс анық: K3 — агенттік тапсырмалар үшін өте қуатты құрал.

Кодтау, инженерия және автономдылық

K3 адамның минималды қатысуымен ұзақ инженерлік сессияларды жүргізуге қабілетті. GPU ядроларын оңтайландыру тестінде модель 24 сағатқа дейін автономды жұмыс істеп, Fable 5 деңгейінде нәтиже көрсетіп, Opus 4.8, GPT-5.6 Sol және GPT-5.5-тен айтарлықтай озып кетті. K3-тің нөлден MiniTriton — MLIR үстінде өзінің IR қабаты бар GPU ядроларына арналған ықшам компиляторды жазу қабілеті ерекше атап өтуге тұрарлық.

Чиптерді жобалау демонстрациясы да әсерлі: K3 өз архитектурасында нейрожелілік чипті өз бетінше жобалады. 48 сағаттық автономды жұмыс ішінде, ашық бастапқы құралдарды пайдалана отырып, модель ауданы 4 мм², жиілігі 100 МГц және симуляцияда секундына 8700 токеннен астам өнімділігі бар чип дизайнын жасады.

Біліммен жұмыс және мультимодальдылық

K3 ғылыми деректерді терең түсінуді көрсетеді. Бір жағдайда модель есептеу астрофизикасындағы күрделі формулаларды екі сағат ішінде қайта жаңғыртты, ал тәжірибелі зерттеушіге бұл бірнеше апта қажет болар еді. Басқа мысалда K3 ASIC индустриясының 42 жылдық тарихы туралы интерактивті есеп дайындап, 11 000 беттен астам құжатты өңдеді.

Бейнемен туа біткен жұмыс істеу қабілетінің арқасында модель бейнероликтерді монтаждауға, оларды музыкамен синхрондауға және дыбысты өңдеуге қабілетті. Бұл шығармашылық процестерді автоматтандыру үшін жаңа көкжиектер ашады.

Шектеулер мен қолжетімділік

Moonshot AI командасы K3 агенттік ортаны ауыстырған кезде ойлау тарихын жоғалтуға сезімтал екенін және екіұшты жағдайларда шамадан тыс бастама көрсетуі мүмкін екенін адал мойындайды. Пайдалану ыңғайлылығы бойынша ол әзірге Fable 5 және GPT-5.6 Sol флагмандарынан төмен.

Модель Kimi сайтында, Kimi Work және Code қызметтерінде, сондай-ақ API арқылы қолжетімді. Әдепкі бойынша максималды ойлау режимі іске қосылған. Толық салмақтар мен техникалық есеп 27 шілдеде жарияланады.

Сарапшының пікірі: Kimi K3 шығарылымы — бұл жай ғана параметрлер саны бойынша кезекті рекорд емес. Бұл ашық модельдердің жабық алыптармен ең жоғары деңгейде, әсіресе агенттік және инженерлік тапсырмаларда бәсекелесуге қабілетті екендігінің дәлелі. Дегенмен, пайдалану ыңғайлылығындағы алшақтық және контекстің өзгеруіне сезімталдық «шикі» қуаттың теңдеудің бір бөлігі ғана екенін еске салады. ЖИ-дегі көшбасшылық үшін жарыс енді ғана басталып жатыр және біз ашық сектордың қарқынын арттырып жатқанын көріп отырмыз.