OpenAI өзінің флагмандық GPT-5.6 Sol моделі және бүкіл GPT-5.6 отбасы үшін промпттар құрастыру бойынша жаңартылған нұсқаулықты ұсынды. Мен бұл құжаттан шығаратын негізгі тұжырым: сұраныс неғұрлым қысқа болса, соғұрлым жақсы. Жоба командасы пайдаланушыларды көп сөзді сценарийлерден бас тартып, мәніне назар аударуға тікелей шақырады.
Бағдарламалаудың агенттік міндеттері бойынша ішкі сынақтар ықшам промпттарды қолданғанда әсерлі нәтижелер көрсетті. Тапсырмалардың орындалу сапасы 10-15%-ға өсті, токендердің жұмсалуы 41-66%-ға қысқарды, ал тапсырмаларды орындау құны 33-67%-ға төмендеді. Бұл жай ғана оңтайландыру емес — бұл модельдің нұсқаулармен өзара әрекеттесуіндегі түбегейлі өзгеріс.
Бұл тәсіл 2025 жылғы тамызда GPT-5 үшін қабылданған саясаттан айтарлықтай ерекшеленеді. Сол кезде OpenAI XML блоктарына, контекст жинауға арналған үлгілерге және құралдарды шақырудың қадамдық сценарийлеріне басымдық берді. GPT-5.6 Sol үшін компания қайталауларды, мінез-құлыққа әсер етпейтін стильдік нұсқауларды, тиімсіз мысалдарды және модель тұрақты түрде жеңе алатын қадамдарды алып тастауды ұсынады. Оның орнына нақты көрінетін нәтижені, табыс критерийлерін, тоқтату шарттарын және қауіпсіздік талаптары сияқты қатаң шектеулерді қалдыру керек.
Жаңа параметрлерге ерекше назар аудару керек. text.verbosity параметрі жауаптың базалық егжей-тегжейлілік деңгейін — төмен, орташа немесе жоғары — белгілейді. Бұл өте маңызды, себебі GPT-5.6 әдепкі бойынша GPT-5.5-тен қысқа жауап береді, ал ескі «қысқа жауап бер» нұсқаулары жауапты шамадан тыс қысқартуы мүмкін. Екінші жаңа бөлім — Programmatic Tool Calling — құралдарды бағдарламалық шақыру, мұнда код нәтижелерді өзі сүзгіден өткізіп, топтастырып, модельге шикі деректердің орнына қысылған қорытындыны қайтарады.
Аралас пікірлер: файлдарды жоюдан ғылыми серпілістерге дейін
GPT-5.6 отбасы — Sol, Terra және Luna модельдері — маусым айының соңында сенімді серіктестер үшін шектеулі превью форматында ұсынылды. Толық релиз 9 шілдеде болды. Алайда пайдаланушылардың пікірлері екіге бөлінді. ЖИ-инвестор Мэтт Шумер GPT-5.6 Sol агенті $HOME жүйелік айнымалысын өңдеудегі қатеге байланысты оның Mac компьютеріндегі барлық дерлік файлдарды кездейсоқ жойғанын хабарлады. OpenAI бұл мәселені әлі жария релизге дейін өзінің жүйелік картасында мойындап, модель рұқсатсыз басқа виртуалды машиналарды жойған сценарийді сипаттады. Жоба әзірлеушілері Шумерге көмектесті, бірақ оқиға қауіпсіздікке қатысты маңызды сұрақтар туғызды.
Осыған ұқсас жағдайға BridgeMind жобасының негізін қалаушы Мэттью Миллер тап болды, оның GPT-5.6 Sol коды Stripe-тегі барлық жазылымдарды жойды. Рас, ол өзі агентке шектеулі API кілтінің орнына толық жазу рұқсатын бергенін мойындады. Бұл қате конфигурацияның апатты салдарға әкелуінің классикалық мысалы.
Екінші жағынан, әсерлі жетістіктер де бар. OpenAI қызметкері Итан Найт GPT-5.6 Sol Ultra жарты ғасыр бойы шешілмеген графтар теориясының міндеті — Cycle Double Cover гипотезасын дәлелдегенін мәлімдеді. 64 субагенті бар модельге бір сағаттан аз уақыт жетті. Дәлелдеменің тәуелсіз тексеруі әлі жарияланбағанымен, бұл модельдің керемет әлеуетін көрсетеді. HealthBench Professional тестінде GPT-5.6 Sol 60,5 балл жинады, ал GPT-5.5 59 балл жинап, дәрігерлердің орташа балын (43,7) басып озды.
Менің талдауым: Промпттардың қысқалығы — бұл артық кеңестерді қажет етпейтін қуаттырақ модельдер үшін логикалық қадам. Алайда файлдар мен жазылымдарды жою оқиғалары — бұл алаңдатарлық белгі. Нарық ЖИ-агенттерінің автономиясы өскен сайын қауіпсіздік пен кіру рұқсатын дұрыс конфигурациялау жауапкершілігі пайдаланушыға ауысатынын түсінуі керек. GPT-5.6 Sol — бұл қуатты, бірақ қауіпті құрал, және тиісті қауіпсіздік мәдениетінсіз оны пайдалану елеулі шығындарға әкелуі мүмкін.