Жылдамдық жаávısы: Google және OpenAI жаңа буын ИИ-шешімдерін ұсынды

13 тамызда жасанды интеллект нарығына қосарланған соққы жасалды: Google Gemini 3.7 Flash моделін жариялады, ал OpenAI GPT-5.6 Sol үшін революциялық Ultrafast режимін ұсынды. Екі әзірлеме де бағдарламалау мен автономды ИИ-агенттерге қатысты жоғары жылдамдықты тапсырмаларды орындауға бағытталған маңызды сегментке бағытталған.
Gemini 3.7 Flash: тиімділік пен үнемділікке ставка
Google-дің жаңа моделі корпоративтік сектор мен әзірлеушілерге арналған жұмысшы күші ретінде ұсынылуда. Негізгі жақсартулар көп сатылы жоспарлауға, нұсқауларды дәл орындауға және код генерациялауға қатысты. Алайда ең қызықты аспект бағаның түбегейлі төмендеуі болды: пайдалану құны алдыңғы нұсқаның бағасымен салыстырғанда екі есеге төмендеді.
Flash желісі дәстүрлі түрде латенттілік маңызды болатын сценарийлерді қамтиды: бұл кодинг, агенттік пайплайндар және модельге бірнеше реттік қоңырауларды қажет ететін тапсырмалар. Еске салайын, шілдеде Gemini 3.6 Flash миллион кіріс токеніне $1,5 және миллион шығыс токеніне $7,5 бағасымен шыққан болатын. Сол кезде компания 3.5 Flash-пен салыстырғанда шығыс токендерін тұтынуды 17 пайызға қысқартқанын хабарлады.
Флагмандық Gemini 3.5 Pro әлі күнге дейін серіктестермен жабық тестілеу сатысында екендігі және оның жария шығарылымының мерзімі тұманды болып қалуы айғақты. Бұл қызықты теңгерімсіздік тудырады: Google премиум-модельдерге емес, жаппай сегментке ставка жасап отырғаны анық.
OpenAI Ultrafast: Cerebras негізінде секундына 750 токен
OpenAI өз козырымен — GPT-5.6 Sol үшін Ultrafast режимімен жауап берді. Мәлімделген көрсеткіштер таңғалдырады: стандартты нұсқамен салыстырғанда 14 есеге дейін үдеу және секундына 750 шығыс токеніне дейін генерациялау. Технологиялық негіз ретінде алып кремний пластиналарына маманданған Cerebras инфрақұрылымы алынды.
Бастапқыда Ultrafast-қа API арқылы тек шектеулі клиенттер пулы қол жеткізе алады. Бұл саналы қадам: OpenAI есептеу қуаттарын кезең-кезеңмен арттырып, жаңа пайдаланушыларды біртіндеп қосатын болады. Айта кету керек, секундына 750 токен көрсеткіші маусымдағы GPT-5.6 жарияланымында да айтылған еді, алайда сол кезде компания үдетілген нұсқаға біркелкі емес қолжетімділік туралы ескерткен болатын.
Бәсеке контекстін SpaceXAI-дің ұзақ мерзімді агенттік сценарийлер мен интерактивті қосымшаларға бағытталған тамыздағы Grok 4.6 релизі күшейтеді.
Менің талдауым: Біз бәсекелестік күрестегі тектоникалық ығысуды байқап отырмыз — жауаптардың сапасынан оларды алу жылдамдығына қарай. Google-дің Flash-модельдерінің арзандауы мен OpenAI-дің агрессивті ультражылдам режимі — бұл ашық модельдер тарапынан келетін қысымның тікелей салдары. Алайда секундына 750 токен — бұл жай маркетинг емес: мұндай көрсеткіштер пайдаланушымен айтарлықтай кідіріссіз әрекеттесе алатын real-time агенттерге жол ашады. Мәселе тек Cerebras-тың бұл технологияны демократияландыру үшін жеткілікті жылдам масштабтала алатынында немесе ультражылдамдық таңдаулы корпоративтік клиенттердің артықшылығы болып қалатынында.