Рио 3.5: Рио-де-Жанейро мэриясының «бірегей» жасанды интеллект моделімен байланысты жанжал

Рио-де-Жанейроның муниципалды IT-компаниясы IplanRIO Rio 3.5 Open 397B моделін ұсынып, бұл мемлекеттік қаражатқа оқытылған және бірқатар бенчмарктар бойынша DeepSeek V4 Pro мен Qwen 3.7 Plus-тан асып түсетін ашық ЖИ-модель екенін мәлімдеді. Алайда келесі күні-ақ Nex ЖИ әзірлеушілер тобы бұл құрал олардың өздерінің Nex-N2-Pro моделі мен Qwen3.5-397B-A17B-нің тікелей біріктірілуі екенін мәлімдеді.
Осы шағымдардан кейін IplanRIO Hugging Face-тегі модель карточкасын жедел жаңартты. Жаңа нұсқада Rio 3.5 Nex-N2-Pro мен Qwen3.5-397B-A17B-ні біріктіру, содан кейін күштірек модельден дистилляциялау арқылы құрылғаны көрсетілген.
Rio 3.5 қалай таныстырылды
IplanRIO Rio 3.5 Open 397B-ді 2026 жылғы 13 маусымда Hugging Face-ке MIT лицензиясымен жүктеді. Бастапқы сипаттамада жобаны «озық деңгейдегі» жалпы мақсаттағы ЖИ-жүйе деп атап, модель Qwen3.5-397B-A17B негізінде қосымша оқытылғаны көрсетілді. Сипаттамаларға 397 млрд параметр кірді, оның 17 млрд-ы әрбір токенді өңдеу кезінде іске қосылады (Mixture-of-Experts архитектурасы), 1,01 млн токенге дейінгі контексттік терезе және SwiReasoning фреймворкін пайдалану. Карточканың бірінші нұсқасында Rio 3.5 бәсекелестерден асып түскен сынақ нәтижелері келтірілді: Terminal-Bench 2.1-де — 70,8% Qwen 3.7 Plus-тағы 70,3% және DeepSeek V4 Pro-дағы 67,9%-ға қарсы; Humanity’s Last Exam-де — 36,5% Qwen 3.7 Plus-тағы 34,7%-ға қарсы; IMOAnswerBench-те — 89,5%.
Nex не мәлімдеді
14 маусымда Nex GitHub-тағы Nex-N2 репозиторийінде өтініш ашып, Rio 3.5 салмақтары Nex-N2-Pro мен Qwen3.5-397B-A17B-нің тікелей элементтік біріктірілуіне ұқсайтынын мәлімдеді. Nex бағалауы бойынша, Rio 3.5 шамамен 60% Nex-N2-Pro және 40% Qwen3.5-397B-A17B-ден тұрады. Компания IplanRIO-ның дербес оқыту белгілерін таппады. Екі негізгі дәлел: «You are Rio» жүйелік промптын жойғаннан кейін модель 79% жауапта өзін «Nex, from Nex-AGI» деп атады және Rio салмақтарының әрбір тензоры модельдің барлық 60 қабатында Nex пен Qwen арасындағы 0,6/0,4 пропорциясын қайталайды. «Бұған бейкүнә түсініктеме жоқ», — делінген Nex мәлімдемесінде.
Неліктен бенчмарктар сұрақ тудырды
Nex-N2-Pro өз сынақтарында Rio 3.5-тен жоғары нәтижелер көрсетеді: Terminal-Bench 2.1-де 75,3% Rio 3.5-тегі 70,8%-ға қарсы, және GDPval-де 1585 балл 1533-ке қарсы. Егер Rio шынымен қоспа болса, оның әлсіз нәтижелері күтілгендей көрінеді. Карточка жаңартылғаннан кейін бұл бенчмарктар негізгі сипаттамадан алынып тасталды.
IplanRIO қалай жауап берді
Шағымдардан кейін IplanRIO модельдің README файлын өзгертіп, Rio 3.5 Nex-N2-Pro мен Qwen3.5-397B-A17B-ні біріктіру арқылы құрылғанын, содан кейін дистилляциядан өткенін көрсетті. «Біз шатасуға өкінеміз және кешірім сұраймыз», — делінген жаңартылған README-де. Топ дұрыс модельді қайта жүктеу үшін жұмыс істеп жатыр. Жариялау кезінде жеке толыққанды қоғамдық түсініктеме болған жоқ.
Даудың мәні неде
Ашық модельдерді пайдаланудың өзі (Apache 2.0 лицензиясымен Nex-N2-Pro, Qwen3.5-397B-A17B — ашық модель) бұзушылық емес. Дау таныстырылымнан туындады: бастапқы карточка Qwen негізінде дербес әзірлеу және қосымша оқыту әсерін қалыптастырды, бірақ Nex-N2-Pro-ны көздердің бірі ретінде көрсетпеді. Open-source қауымдастығында бұл ашықтық мәселесі ретінде қабылданады. Ашық салмақтарды біріктіру және дистилляция әдеттегі тәжірибеге айналды, бірақ әзірлеушілерден бастапқы модельдер мен үшінші тарап топтарының үлесін ашу күтіледі.
Менің пікірім: Бұл оқиға — ЖИ-де көшбасшылық үшін жарыста ашықтықтың зардап шегуінің айқын мысалы. Криптоқауымдастық үшін, мұнда тексеру мен дәлелдер сенімнің негізі болып табылады, мұндай тәсіл қолайсыз. Егер IplanRIO басынан бастап көздерді адал көрсеткенде, жанжал болмас еді. Оның орнына біз ашық модельдердің комбинациясын өз серпілісі ретінде көрсету әрекетін көріп отырмыз, бұл жобаға ғана емес, осы саладағы мемлекеттік бастамаларға деген сенімге де нұқсан келтіреді.