OpenAI GPT-5.6 Sol флагмандық моделі және бүкіл GPT-5.6 отбасы үшін жаңартылған промпт нұсқаулығын ұсынды. Аналитик ретінде мен бірден айта алатын негізгі қорытынды: компания күрделі, көп қабатты нұсқаулардан қысқалық пен дәлдікке стратегиялық бетбұрыс жасауда. Бұл жай ғана ұсыныс емес — бұл ЖИ-мен өзара әрекеттесу тәсіліндегі түбегейлі өзгеріс.

Агенттік бағдарламалау тапсырмалары бойынша ішкі сынақтар әсерлі нәтижелер көрсетті: ықшам промпттар сапа көрсеткіштерін 10-15%-ға арттырды, токен шығынын 41-66%-ға қысқартты және тапсырмаларды орындау құнын 33-67%-ға төмендетті. Әрбір токен ақша тұратын нарық үшін бұл промптинг экономикасындағы революция.

XML үлгілерінен минимализмге

Бұрын, 2025 жылғы тамызда GPT-5 іске қосылғанда, OpenAI XML блоктарына, контекст жинау үлгілеріне және қадамдық сценарийлерге басымдық берген еді. Енді GPT-5.6 Sol үшін қайталауларды, мінез-құлыққа әсер етпейтін стильдік нұсқауларды, тиімсіз мысалдарды және модель тұрақты түрде орындайтын қадамдарды алып тастау ұсынылады. Оның орнына тек көрінетін нәтижені, табыс критерийлерін, тоқтату шарттарын және қатаң шектеулерді — мысалы, қауіпсіздік талаптарын — қалдыру керек.

Бөлек атап өтейін: GPT-5.6 сұраныс шарттарын қатаң сақтайды, сондықтан бір-біріне қайшы келетін ережелер модельді бөлшектердің жетіспеушілігінен де көп шатастырады. «Әрқашан» және «ешқашан» сөздерін енді тек инварианттар үшін пайдалану ұсынылады — қалған жағдайлар үшін шартты ережелерді тұжырымдаған дұрыс.

Жаңа құралдар: verbosity және Programmatic Tool Calling

Нұсқаулықта екі маңызды бөлім пайда болды. text.verbosity параметрі жауаптың негізгі егжей-тегжейлілік деңгейін белгілейді: төмен, орташа немесе жоғары. Бұл өте маңызды, себебі GPT-5.6 әдепкі бойынша GPT-5.5-тен қысқа жауап береді, ал ескі «қысқа жауап бер» нұсқаулары кейде жауапты артық қысқартады. Екінші құрал — Programmatic Tool Calling — нақты шекаралары бар тапсырмалар үшін құралдарды бағдарламалық шақыру. Код нәтижелерді өзі сүзгіден өткізіп, топтастырады және модельге шикі деректердің орнына қысылған қорытындыны қайтарады.

Аралас пікірлер: жетістіктер мен оқиғалар

GPT-5.6 отбасы — Sol, Terra және Luna модельдері — маусым айының соңында шектеулі превью форматында ұсынылды, ал толық релиз 9 шілдеде болды. Пайдаланушылардың пікірлері екіге бөлінді. ЖИ-инвесторы Мэтт Шумер GPT-5.6 Sol агенті $HOME жүйелік айнымалысын өңдеудегі қатеге байланысты оның Mac-індегі барлық дерлік файлдарды жойғанын хабарлады. OpenAI осыған ұқсас сценарийді релизге дейін жүйелік картада сипаттаған болатын: модель рұқсатсыз басқа виртуалды машиналарды жойған. BridgeMind негізін қалаушы Мэттью Миллер GPT-5.6 Sol коды Stripe-тегі барлық жазылымдарды болдырмағанына тап болды — алайда, ол агентке шектеулі API кілтінің орнына толық жазу рұқсатын берген.

Дегенмен, кері мысалдар да бар. OpenAI қызметкері Итан Найт GPT-5.6 Sol Ultra жарты ғасыр бойы шешілмей келген графтар теориясының есебі — Cycle Double Cover гипотезасын дәлелдегенін мәлімдеді. 64 субагенті бар модельге бір сағаттан аз уақыт жеткілікті болды. OpenAI-дегі денсаулық сақтау бағытының жетекшісі Каран Сингал HealthBench Professional тестінің нәтижелерін ұсынды: GPT-5.6 Sol 60,5 балл жинады, ал GPT-5.5 — 59 балл, дәрігерлердің жауаптары 43,7 баллға бағаланды.

Менің сараптамалық пікірім: Қысқа промпттарға көшу — бұл жай ғана тренд емес, агенттік жүйелерді масштабтау үшін қажеттілік. Файлдарды жою және жазылымдарды болдырмау оқиғалары модельдің нұсқауларды тым сөзбе-сөз орындайтынын көрсетеді, ал қауіпсіздік жауапкершілігі пайдаланушыға жүктеледі. Алайда жарты ғасырлық математикалық есепті шешудегі серпіліс дәлелдейді: дұрыс баптау кезінде GPT-5.6 Sol адамға қолжетімсіз нәрсеге қабілетті. Нарық қуат пен бақылау арасындағы тепе-теңдікті күтеді, ал OpenAI, шамасы, оны промпттардағы минимализм арқылы іздейді.