Лондондық гуманоид роботтарды әзірлеуші Humanoid компаниясы KinetIQ Ascend — роботтарға өндірістік операцияларды нақты жағдайда сынақ және қателік әдісімен меңгеруге мүмкіндік беретін оқыту әдістемесін ұсынды. Технология күшейтілген оқытуға (reinforcement learning, RL) негізделген және компанияның мәлімдемесі бойынша, адам жылдамдығымен салыстырылатын немесе одан асып түсетін жылдамдықта манипуляциялардың сәттілігін 99,9%-ға дейін жеткізе алады.
KinetIQ Ascend Humanoid компаниясының барлық роботтарының негізінде жатқан KinetIQ фреймворкінің мүмкіндіктерін кеңейтеді. Жаңа тәсілдің басты айырмашылығы — RL оқыту симуляцияда емес, тікелей нақты жабдықта тәулік бойы жүргізіледі. Бұл өнеркәсіптік орналастыру жағдайында нақты екі қолды гуманоид платформада оқытылған VLA-модельдері (vision-language-action) үшін көзге негізделген толық RL оқытудың алғашқы жария түрде жарияланған демонстрациясы.
Бұрын Humanoid, көптеген бәсекелестер сияқты, имитациялық оқытуға — адам демонстрацияларын көшіруге сүйенген. Алайда бұл тәсілдің түбегейлі шектеуі бар: модель демонстратордан жылдамдық бойынша да, сапа бойынша да асып кете алмайды және өз қателіктерінен үйренбейді. KinetIQ Ascend бұл мәселені үздіксіз тәжірибе арқылы шешеді, бұл үлкен тілдік модельдерді масштабтауға ұқсас — оқыту неғұрлым ұзақ болса, сәттілік соғұрлым жоғары болады.
Өндірістік тапсырмалардағы сынақ нәтижелері
Humanoid KinetIQ Ascend-ті үш нақты операцияда A/B-сынау жүргізді:
- Болат мойынтірек сақиналарын контейнерден ұстап алу және конвейерге орналастыру. RL оқытудан кейін өткізу қабілеті 42%-ға — сағатына 291-ден 412 сақинаға дейін өсті.
- Затты контейнерден адамға беру. Өткізу қабілеті 85%-ға өсті, эпизодтың орташа ұзақтығы 35%-ға қысқарды, ал сәттілік 80%-дан 98%-ға дейін өсті.
- Контейнерді екі қолмен кездейсоқ бағдарда үстелден көтеру. Бірнеше күндік оқытудан кейін өткізу қабілеті сағатына 122-ден 279 контейнерге дейін өсті, эпизод уақыты 22,9 секундтан 12,8 секундқа дейін қысқарды, ал сәттілік 77,6%-дан 98,9%-ға дейін көтерілді.
Компания сондай-ақ операцияның ең күрделі кезеңін жақсарту бүкіл тапсырманың нәтижесін арттыра алатынын және дағды RL оқыту кезінде робот көрмеген нысандарға ауысатынын атап өтті. Бұл жағдайлар үнемі өзгеріп отыратын нақты өндірістік орталар үшін өте маңызды.
Өнеркәсіптік стратегия және бәсекелестік
Humanoid Еуропада өндірістік тізбекті белсенді түрде құруда. Мамыр айында компания Bosch-пен серіктестік туралы жариялады, ол еуропалық нарық үшін HMND 01 роботтарының келісімшарттық өндірушісі болады. Бұған дейін Schaeffler-мен 2032 жылға қарай серіктестіктің жаһандық алаңдарында 1000-нан 2000-ға дейін роботты орналастыру туралы кезеңдік келісім жасалды.
KinetIQ Ascend жариялануы гуманоид робототехникасындағы бәсекенің күшеюі аясында жүріп жатыр. Figure $39 млрд бағалаумен $1 млрд-тан астам қаражат тартты, Apptronik Google және Mercedes-Benz қоса алғанда, инвесторлардан $935 млн алды. Қытай 2024 жылдан бастап робототехниканы дамытуға кемінде $20 млрд бағыттады, дегенмен нақты сатылымдар әлі шектеулі — негізінен зерттеу мақсаттарына арналған шамамен 12 000 гуманоид робот.
Менің сараптамалық пікірім: KinetIQ Ascend — бұл өнеркәсіптік роботтарды оқытудағы эволюция ғана емес, парадигманың өзгеруі. Имитациядан нақты жабдықтағы RL-ге көшу адам әрекеттерін көшіру кезінде сөзсіз болатын жылдамдық пен сапаның «төбесі» мәселесін шешеді. Егер Humanoid бұл тәсілді Bosch және Schaeffler-мен серіктестікте мыңдаған роботтарға масштабтай алса, компания әлі де симуляциялар мен демонстрацияларға сүйенетін бәсекелестерден озып, өнеркәсіптік робототехникадағы негізгі ойыншылардың біріне айналуы мүмкін.