Біз жасанды интеллект объективті машина деп ойлауға дағдыланғанбыз. Алайда Anthropic командасының жаңа терең зерттеуі бұл түсінікті түбегейлі өзгертеді. Claude-мен қарым-қатынас тілін ауыстыру жауаптағы сөздерді ғана емес, нейрожелінің құндылықтар жүйесін түбегейлі өзгертеді екен. Ал орыс тілі бұл жерде ең айқын мысал болып табылады.

Мамандар 20 тілдегі 300 000-нан астам диалогты талдап, Claude-ның анықталған 3000 құндылығын төрт іргелі мінез-құлық өсіне жинақтады. Нәтижелер таңқалдырады: «Жылылық пен Қатаңдық» шкаласы бойынша нейрожелінің орыс тіліндегі нұсқасы басқа тілдерге қарағанда қатаңдық полюсіне күштірек ығысады. Әдеттегі достық қолдаудың орнына Claude орыс тілінде талапшыл рецензент ретінде әрекет етеді: ол алғышарттарды даулайды, бөлшектерді түзетеді және дәлелдемелерді талап етеді. Шкаланың қарама-қарсы шетінде араб және хинди тілдері орналасқан, мұнда модель, керісінше, барынша жылы және мақұлдаушы.

Практикалық салдары орасан зор. Елестетіңіз: екі адам бір бизнес-жоспарды бағалауды сұрайды — біреуі орыс тілінде, екіншісі хинди тілінде. Орыс тілді пайдаланушы жоғары ықтималдықпен түзетулер мен негіздемелерді талап ететін сыни талдау алады. Ал хинди тілді пайдаланушы жұмсақ, ынталандырушы кері байланыс алады. Іс жүзінде, қызмет сапасы мен пайдаланушының әсері AI-ға қай тілде жүгінетініне тікелей байланысты.

ЖИ құндылықтарының төрт өсі

Зерттеушілер модельдің мінез-құлқы бағаланған төрт негізгі параметрді анықтады: Көнгіштік пен Сақтық, Жылылық пен Қатаңдық, Тереңдік пен Қысқалық және Ашықтық пен Нәтиже. Дәл «Жылылық-Қатаңдық» өсі бойынша тілдер арасындағы алшақтық ең жоғары болды. Басқа өстер бойынша модель салыстырмалы түрде тұрақты болып қалады.

Авторлардың өздері мұндай әсердің нақты себебін әзірге білмейді. Негізгі гипотеза — оқыту деректерінің тілдер бойынша біркелкі бөлінбеуі. Деректер неғұрлым көп болса, құндылықтардың біркелкілігіне қол жеткізу оңайырақ. Сонымен қатар, әртүрлі тілдердегі кәсіби мәтіндер әртүрлі нормалар мен құндылықтарды алып жүреді. Алайда Anthropic бұл айырмашылықтар жоспарланбағанын және компания бұл вариативтілікпен айналысуға ниетті екенін атап өтеді.

Модельдің де маңызы бар

Тіл — жалғыз фактор емес. Модельдің нұсқасы да құндылықтар профиліне қатты әсер етеді. Sonnet 4.6 жылылық пен көнгіштікке бейім, көбінесе пайдаланушының идеяларын мақұлдайды. Opus 4.7, керісінше, сақтық пен тереңдікке ығысқан — ол жалған алғышарттарды даулайды, ашық сын береді және тәуекелдер туралы ескертеді. Қорытынды мінез-құлық — таңдалған тіл мен модельдің күрделі комбинациясы.

Сарапшының пікірі: Бұл жаңалық криптоиндустрияға тікелей қатысты. Егер AI-көмекшілер әртүрлі тілдердегі бизнес-жоспарлар мен аналитиканы әртүрлі бағаласа, бұл жаһандық командалар үшін тең емес жағдайлар туғызады. Орыс тілді криптожобалар араб немесе үнді аймақтарындағы бәсекелестеріне қарағанда AI-дан жүйелі түрде қатаңырақ сын алуы мүмкін. Бұл баг емес, нейрожелілерді оқытудың іргелі ерекшелігі, оны жаһандық стратегияларды құру кезінде ескеру қажет. Anthropic құндылықтарды профильдеуді модельдерді релизге дейін және одан кейін бағалауға енгізуді жоспарлап отыр — бұл ЖИ-дің «мінезін» саналы бақылауға қарай маңызды қадам болады.