309 815 диалогты қамтыған ауқымды зерттеу барысында әзірлеушілер тобы тілдік модельдердің мінез-құлқының іргелі ерекшелігін анықтады: қарым-қатынас тілін ауыстыру тек сөздік қорды ғана емес, сонымен қатар нейрожелі көрсететін құндылықтар жүйесінің өзін түбегейлі өзгертеді. Бұл құбылыс орыс тілді сессияларды талдау кезінде айқын көрінді.

Мамандар Claude-ның бұрын анықталған 3000-нан астам құндылықтарын төрт негізгі оське жинақтады: Көнгіштік пен Сақтық, Жылылық пен Қатаңдық, Тереңдік пен Қысқалық және Ашықтық пен Нәтижелілік. Дәл осы шкалалар модель мінез-құлқындағы барлық өзгергіштіктің 15% түсіндіреді. Негізгі қорытынды: құндылықтар профилі тек әртүрлі модельдер арасында ғана емес, сонымен қатар, бұдан да маңыздысы, платформаның ең танымал 20 тілі арасында өзгереді.

Орыс тілі қатаңдық полюсі ретінде

Ең маңызды ауытқулар «Жылылық vs. Қатаңдық» және «Ашықтық vs. Нәтижелілік» осьтері бойынша жүреді. Орыс тілі ағылшын тілімен бірге қатаңдық полюсінде шеткі орынды алды. Бұл орыс тілінде сөйлескен кезде Claude-ның жігерлендіретін әңгімелесуші емес, талғампаз рецензент ретінде әрекет ету ықтималдығы айтарлықтай жоғары екенін білдіреді. Ол бастапқы алғышарттарға белсенді түрде қарсы шығады, мәліметтерді түзетеді, дәлелдерді талап етеді және сыни талдау жасайды.

Салыстыру үшін, араб және хинди тілдерінде модель максималды жылылыққа ауысады, пайдаланушының идеяларына сыпайылық, әзіл және мақұлдау көрсетеді. Практикалық салдары анық: бірдей бизнес-жоспар сұраныс тіліне байланысты мүлдем басқа баға алады. Орыс тілді пайдаланушы қатаң сынға және негіздеме талаптарына жоғары ықтималдықпен тап болады, ал хинди тілді пайдаланушы жұмсақ және жігерлендіретін реакцияға ие болады.

Модельдің де маңызы бар

Тіл жалғыз фактор емес екенін түсіну маңызды. Модельдің нақты нұсқасын таңдау да із қалдырады:

  • Sonnet 4.6 көнгіштікке, жылылыққа және қысқалыққа бейім, көбінесе идеяларды мақұлдап, әзіл қолданады.
  • Opus 4.7 сақтық пен тереңдікке ауысады, жалған алғышарттарға қарсы шығып, ашық сын береді.
  • Opus 4.6 қатаңдыққа, көнгіштікке және қысқалыққа бейім аралық позицияны алады.

Зерттеушілер бұл айырмашылықтардың себебін әлі нақты анықтай алмайды. Негізгі гипотеза — оқу деректерінің тілдер бойынша біркелкі бөлінбеуі. Деректер көп жерде құндылықтардың біркелкілігіне қол жеткізу оңайырақ. Сонымен қатар, әртүрлі тілдердегі мәтіндердің құрамы ерекшеленеді: кәсіби корпустар сөйлеу корпустарынан өзгеше құндылықтық көзқарастарды алып жүруі мүмкін.

Менің сараптамалық пікірім: Тұжырымдардың дәлдігі мен сыни талдау басты мәнге ие криптоиндустрия және DeFi-секторы үшін орыс тілді Claude-ның мұндай «қатаңдығы» кемшілік емес, керісінше артықшылық. Алайда әзірлеушілер мен пайдаланушылар күрделі техникалық шешімдерді бағалау кезінде түсінбеушілікке жол бермеу үшін осы тілдік ауысымды ескеруі маңызды. Anthropic компаниясы модельдерді бағалау және бақылау процесіне құндылықтарды профильдеуді енгізуді жоспарлап отыр, бұл осы қасақана емес өзгергіштікті жақсырақ бақылауға мүмкіндік береді. Мұндай өзгергіштіктің қаншалықты қажетті екендігі туралы мәселе ашық күйінде қалады, бірақ жоғары тәуекелді ортаға үйренген криптоқауымдастық үшін қатаң және талапшыл ИИ-көмекші «жылы» әңгімелесушіден әлдеқайда пайдалы болуы мүмкін.