Жылдамдық жарысы: Google және OpenAI жаңа буын ИИ шешімдерін ұсынды

Жасанды интеллект нарығы әлі де дүрлігіп тұр: 13 тамызда екі технологиялық алып бірден өз жаңартуларын ұсынды, олар бір салаға — әзірлеушілер мен ИИ-агенттерге арналған өте жылдам тапсырмаларды өңдеуге бағытталған. Google Gemini 3.7 Flash-ты ұсынса, OpenAI өзінің флагмандық GPT-5.6 Sol моделіне арналған Ultrafast режимін жариялады. Бұл жай эволюция емес, индустрияның қай бағытта қозғалып жатқаны туралы нақты сигнал: шикі қуатқа ғана емес, жылдамдық пен тиімділікке қарай.
Gemini 3.7 Flash-тағы жаңалықтар
Google Gemini 3.7 Flash-ты бағдарламалау мен бизнес-процестерді автоматтандыруға арналған жұмысшы көлік ретінде ұсынып отыр. Негізгі жақсартулар көп сатылы жоспарлауға, нұсқауларды дәл орындауға және код генерациясына қатысты. Алайда ең қызықтысы — баға: компания алдыңғы нұсқаның бастапқы бағасымен салыстырғанда пайдалану құнын екі есе төмендететінін мәлімдеді. Бұл агрессивті қадам, әсіресе Flash желісі басынан-ақ жауап жылдамдығы маңызды сценарийлерге бағытталғанын ескерсек: кодинг, агенттер жұмысы және модельге көптеген дәйекті сұраныстары бар тапсырмалар.
Еске сала кетейін, шілдеде Gemini 3.6 Flash 1 млн кіріс токені үшін $1,5 және 1 млн шығыс токені үшін $7,5 бағасымен шыққан болатын. Сол кезде компания жаңа модель 3.5 Flash-қа қарағанда 17%-ға аз шығыс токенін тұтынатынын хабарлады. Ал көбісі күткен флагмандық Gemini 3.5 Pro әлі де ашық қолжетімділікке шыққан жоқ — әзірлеушілер оны әлі де серіктестермен сынап жатыр, ал шығарылым мерзімі бұлыңғыр болып қалуда.
OpenAI GPT-5.6 Sol-ды қалай жылдамдатты
OpenAI симметриялы түрде жауап берді, бірақ басқа екпінмен. Компанияның мәлімдеуінше, GPT-5.6 Sol үшін Ultrafast режимі генерацияны секундына 750 шығыс токеніне дейін жылдамдатады — бұл стандартты режимнен 14 есеге дейін жылдам. Құпия — өте жылдам есептеулерге маманданған Cerebras инфрақұрылымын пайдалануда. Дегенмен, бастапқыда Ultrafast-қа қолжетімділікті API арқылы клиенттердің шектеулі саны ғана алады, ал OpenAI есептеу қуаттарын арттырған сайын қолжетімділікті кеңейтуге уәде береді.
Секундына 750 токен көрсеткіші жаңалық емес — бұл туралы маусымда GPT-5.6 жарияланған кезде айтылған болатын. Сол кезде де Sol-ды Cerebras-та іске қосатыны белгілі болған, бірақ пайдаланушыларды кезең-кезеңімен қосу шартымен. Қазір бұл жоспар жүзеге асып келеді. Осы аяда SpaceXAI-дың тамыздағы Grok 4.6 релизін де еске түсіру керек — бұл модель ұзақ мерзімді агенттік тапсырмалар мен бағдарламалауға бағытталған. Бәсекелестік шегіне жетіп тұр.
Менің талдауым: Екі жарияланым да нақты уақытта жұмыс істей алатын «кіші және жылдам» модельдерге деген трендті растайды. Google-дың бағаны төмендетуі мен OpenAI-дың экстремалды жылдамдығы — бұл бір мәселеге екі түрлі көзқарас: ИИ-ді жаппай автоматтандыруға қолжетімді ету. Қысқа мерзімді перспективада баға мен жауап кідірісінің үздік тепе-теңдігін ұсына алатын жеңеді, әсіресе әрбір қосымша миллисекунд шығын болып табылатын агенттік шешімдер сегментінде.