Жасанды интеллект саласындағы жылдамдық жаávрысы: Google және OpenAI әзірлеушілерге арналған жаңа шешімдерді ұсынды

13 тамызда генеративті ИИ дамуының жаңа векторын айқындаған қос анонс өтті. Google Gemini 3.7 Flash моделін ұсынды, ал OpenAI өзінің GPT-5.6 Sol үшін Ultrafast режимін жариялады. Екі компания да жылдамдық пен тиімділікке басымдық беріп отыр, бұл код және автономды ИИ-агенттермен жұмыс істеуге қатысты тапсырмалар үшін өте маңызды.
Gemini 3.7 Flash-тағы жаңалықтар
Google Gemini 3.7 Flash-ты бағдарламалау мен бизнес-процестерді автоматтандыруға арналған жұмысшы күші ретінде ұсынады. Әзірлеушілер көп сатылы жоспарлау, нұсқауларды орындау дәлдігі және код генерациясының сапасында айтарлықтай жақсартуларды мәлімдейді. Сонымен қатар, компания түбегейлі қадам жасады: пайдалану құны алдыңғы нұсқаның бастапқы бағасымен салыстырғанда екі есе төмендетілді. Бұл модельді ауқымды продакшн жүктемелері үшін өте тартымды етеді.

Flash желісі бастапқыда жауап алу жылдамдығы оның сапасынан кем емес маңызды болатын сценарийлерге арналған шешім ретінде ойластырылған. Бұл кодинг, ИИ-агенттердің жұмысы және модельге көптеген дәйекті сұрауларды қамтитын кез келген тапсырмалар. Еске сала кетейін, шілдеде Gemini 3.6 Flash 1 млн кіріс токені үшін $1,5 және 1 млн шығыс токені үшін $7,5 бағасымен шыққан болатын. Сол кезде компания жаңа модельдің алдыңғысына қарағанда шығыс токендерін 17%-ға аз тұтынатынын хабарлады.
Алайда, осы анонстардың көлеңкесінде флагмандық Gemini 3.5 Pro туралы мәселе қалып отыр. Модель әлі күнге дейін жария түрде шығарылған жоқ, әзірлеушілер оны тек таңдаулы серіктестермен сынап жатыр. Нақты шығарылым мерзімдері бұлыңғыр болып қалуда, бұл нарықта интрига тудырады.
OpenAI GPT-5.6 Sol-ды қалай жылдамдатты
OpenAI, өз кезегінде, GPT-5.6 Sol үшін Ultrafast режимін ұсынды. Мәлімделген көрсеткіштер әсерлі: жұмыс жылдамдығы стандарттыдан 14 есеге дейін жоғары және секундына 750 шығыс токеніне дейін генерация. Мұндай үдеудің құпиясы — ИИ үшін өте жылдам чиптерге маманданған Cerebras инфрақұрылымын пайдалануда.
Бастапқыда Ultrafast API арқылы клиенттердің шектеулі тобына қолжетімді болады. Бұл логикалық қадам: OpenAI жүктемені тексеріп, есептеу қуаттарын масштабтауы қажет. Олар өскен сайын қолжетімділік кеңірек аудиторияға ашылады. Секундына 750 токен көрсеткішінің өзі GPT-5.6 жарияланған кезде, маусым айында айтылған болатын. Сол кезде әзірлеушілер Cerebras-тағы жеделдетілген нұсқа кезең-кезеңімен енгізілетінін ескерткен.
Осы контексте SpaceXAI-дің тамыз айындағы Grok 4.6 релизін де еске алу керек, ол ұзақ мерзімді агенттік тапсырмалар мен бағдарламалауға басымдық берді. "Жылдам" модельдер сегментіндегі бәсекелестік қызып келеді, және бұл нарық үшін тамаша жаңалық.
Менің талдауым: Екі анонс та 2026 жылдың негізгі трендін растайды — назардың "ақылды" модельдерден "жылдам және арзан" модельдерге ауысуы. Web3-әзірлеушілер мен DeFi-протоколдар үшін бұл операциялық шығындардың төмендеуін және нақты уақыт режимінде жұмыс істейтін күрделірек агенттерді құру мүмкіндігін білдіреді. Gemini 3.7 Flash бағасының екі есе төмендеуі — бұл жай маркетинг емес, токен бағасы көбінесе шешуші фактор болып табылатын enterprise-әзірлеу нарығының үлесін иеленуге бағытталған тікелей әрекет.