OpenAI командасы GPT-5.6 Sol флагмандық моделі және бүкіл GPT-5.6 отбасы үшін промптинг бойынша жаңартылған нұсқаулықты шығарды. Құжаттың негізгі мәні — ұзын, көп сатылы сценарийлерден бас тартып, барынша қысқа сұраныстарды қолдану. Бұл GPT-5 алдыңғы нұсқасына арналған нұсқаулармен салыстырғанда тәсілдегі түбегейлі өзгеріс.

Агенттік бағдарламалау тапсырмаларындағы ішкі сынақтар әсерлі нәтижелер көрсетті: ықшам промпттар сапа бағаларын 10-15%-ға арттырды, токен шығынын 41-66%-ға қысқартты және тапсырмаларды орындау құнын 33-67%-ға төмендетті. Тиімділік айқын, және бұл жай теория емес — бұл практикалық деректер.

Бұрын, 2025 жылғы тамызда GPT-5 іске қосылғанда, OpenAI XML блоктарына, контекст жинау үлгілеріне және құралдарды шақырудың егжей-тегжейлі сценарийлеріне басымдық берген еді. Енді GPT-5.6 Sol үшін қайталауларды, стильдік нұсқауларды, тиімсіз мысалдарды және модель тұрақты түрде орындайтын қадамдарды алып тастау ұсынылады. Оның орнына промптта мыналар қалуы керек: көрінетін нәтиже, табыс критерийлері, тоқтату шарттары және қауіпсіздік талаптары сияқты қатаң шектеулер.

Жеке ескерту: GPT-5.6 сұраныс шарттарын қатаң сақтайды. Бір-біріне қайшы келетін ережелер модельді бөлшектердің жетіспеушілігінен де күшті шатастырады. «Әрқашан» және «ешқашан» сөздерін тек инварианттар үшін, ал қалған жағдайларда шартты ережелерді тұжырымдау үшін қолдану ұсынылады.

Нұсқаулықта екі жаңа бөлім пайда болды. Біріншісі — text.verbosity параметрі, ол жауаптың базалық егжей-тегжейлілік деңгейін белгілейді: төмен, орташа немесе жоғары. Бұл маңызды, себебі GPT-5.6 әдепкі бойынша GPT-5.5-тен қысқа жауап береді, ал ескі «қысқа жауап бер» нұсқаулары жауапты шамадан тыс қысқартуы мүмкін. Екіншісі — Programmatic Tool Calling, нақты шекаралары бар тапсырмаларға арналған бағдарламалық құралдарды шақыру. Код нәтижелерді өзі сүзгіден өткізіп, топтастырып, модельге шикі деректердің орнына қысылған қорытындыны қайтарады.

Аралас пікірлер мен оқиғалар

GPT-5.6 Sol туралы пайдаланушылардың пікірлері екіге бөлінді. AI-инвестор Мэтт Шумер бұл модельге негізделген агент $HOME жүйелік айнымалысын өңдеудегі қатеге байланысты оның Mac компьютеріндегі барлық дерлік файлдарды кездейсоқ жойғанын хабарлады. OpenAI мұндай сценарийдің модельдің жүйелік картасында жария шығарылымға дейін сипатталғанын растады және жетілдірулер уәде етті. Әзірлеушілер Шумерге деректерді қалпына келтіруге көмектесті.

BridgeMind жобасының негізін қалаушы Мэттью Миллер де осындай мәселеге тап болды: GPT-5.6 Sol коды Stripe-тегі барлық жазылымдарды жойды. Дегенмен, Миллердің өзі агентке шектеулі API кілтінің орнына толық жазу рұқсатын бергенін мойындады. Бұл модельдің өзіне қатысты мәселе емес, қауіпсіздіктің классикалық қателігі.

Екінші жағынан, әсерлі жетістіктер де бар. OpenAI қызметкері Итан Найт GPT-5.6 Sol Ultra жарты ғасыр бойы шешілмей келген графтар теориясының Cycle Double Cover гипотезасын дәлелдегенін мәлімдеді. 64 субагенті бар модельге бір сағаттан аз уақыт жетті. Тәуелсіз тексеру әлі жарияланбаған, бірақ фактінің өзі таң қалдырады.

Сондай-ақ, HealthBench Professional тестінде GPT-5.6 Sol 60,5 балл жинады, ал GPT-5.5 59 балл жинады, дәрігерлердің орташа бағасынан (43,7 балл) жауаптардың дәлдігі мен толықтығы бойынша асып түсті. Бұл денсаулық сақтау саласында ЖИ қолдану үшін маңызды қадам.

Менің пікірім: Ұзын сценарийлерден қысқа промпттарға көшу — бұл жай оңтайландыру емес, заманауи модельдердің ақылдырақ болғанын мойындау. GPT-5.6 Sol қазірдің өзінде артық нұсқауларсыз контекст пен мақсаттарды түсінеді. Дегенмен, файлдар мен жазылымдарды жою оқиғалары еске салады: ЖИ-ге қаншалықты көп автономия берсек, қауіпсіздіктің нақты шекаралары мен шектеулі кіру құқықтары соншалықты маңызды болады. Технология қуатты, бірақ оны ақылмен басқару керек.