Крипто әлеміндегі жаңалықтар

23.07.2026
16:58

Grok 4.5 бәсекелестерді талқандады: жаңа буын ЖИ-агенттері браузерге шабуыл жасауда

Жасанды интеллект нарығы жаңа кезеңге өтіп жатыр. Ендігі мәселе жай ғана мәтін немесе сурет генерациялау емес — енді ЖИ интернетте өз бетінше әрекет етуді үйренуде. Әзірлеушілер сайттарға кіріп, түймелерді басып, формаларды толтырып, адамның қатысуынсыз деректер жинай алатын «браузерлік көмекшілерді» жасауда. Ал менің деректерім бойынша, бұл жарыста көшбасшы Grok болды.

Browser Use қызметінің негізін қалаушы Грегор Зунич жүргізген бес жетекші ЖИ-құралының салыстырмалы талдауы нақты көшбасшыны анықтады. Өлшем қатаң болды: веб-сайттағы тапсырмаларды бір қатесіз сәтті орындау жиілігі. Міне, осы жерде Grok 4.5 моделіне негізделген Grok әсерлі нәтиже көрсетті — 76,42% дұрыс орындалған тапсырма.

Браузерлік агенттер рейтингінде кім кім

Жағдайды толық түсіну үшін толық бөліністі келтірейін. Екінші орында 72,70% нәтижемен GPT 5.5 моделіндегі OpenAI көмекшісі орналасты. Үшінші және төртінші орындарды Opus 4.8 моделіндегі Anthropic-тің екі құралы алады — 70,75% және 67,92% сәйкесінше. Тізімді 60,38% көрсеткішпен OpenClaw плагині арқылы GPT жабады. Көшбасшы мен соңғы орын арасындағы айырмашылық 16 пайыздық тармақты құрайды, бұл жоғары дәлдіктегі алгоритмдер әлемінде тұңғиық болып табылады.

Барлық көмекшілер бірдей жағдайда жұмыс істегенін атап өту маңызды. Жалғыз айнымалы — шешім қабылдайтын ЖИ-модельдің өзі. Дәл көмекшінің «миы», оның контексті талдау және дұрыс әрекеттер тізбегін таңдау қабілеті нәтижені анықтады. Нәтижелер модельді таңдаудың маңызды екенін айқын көрсетеді.

Бұл нарық үшін нені білдіреді

Бір әзірлеушіде — Anthropic-те — қосылудың екі нұсқасы арасындағы тиімділік айырмашылығы үш тармаққа жуық болғаны қызықты. Бұл интеграция архитектурасы мен браузерге қосылу әдісі нейрожелінің өзінен кем емес маңызды екенін көрсетеді. Біз Grok 4.5 жай ғана жеңіп қоймай, үлкен айырмашылықпен жеңгенін көріп отырмыз, бұл агенттік ЖИ сегментінде бәсекелестердің позициясын күмәнға қалдырады.

Менің талдауым: Автономды браузерлік агенттер нарығы қарқынды жетілуде. Grok 4.5 өзінің қабілетін дәлелдеді, бірақ мен OpenAI мен Anthropic-ті есептен шығаруға асықпас едім. ЖИ-дегі қарулану жарысы енді басталып жатыр, және әрбір жаңа оқыту циклі күштердің арақатынасын түбегейлі өзгерте алады. Дегенмен, пайдаланушылар үшін бұл сөзсіз плюс — бәсекелестік шынымен пайдалы цифрлық көмекшілердің пайда болуын жеделдетеді.