Оксфорд университеті мен Потсдам университетінің сарапшылары жүргізген ауқымды талдау жетекші тілдік модельдер жұмысында жүйелі идеологиялық біржақтылықты анықтады. Зерттеу нысанына xAI, Meta, Google, Alibaba және Mistral компанияларының жүйелері — жасанды интеллект индустриясының негізгі ойыншылары ілікті.
Эксперимент барысында зерттеушілер чат-боттарға сезімтал тақырыптардағы пайдаланушы жобаларын қайта жазуға тапсырып, бастапқы мағынаны сақтауды нақты нұсқады. Нәтижелер алаңдатарлық болды: сыналған барлық модельдерде идеологиялық ауытқулар тіркелді. Оның үстіне, бірқатар жағдайларда жүйелер хабарламалардың бастапқы мазмұнын толығымен бұрмалап, оны мағынасы жағынан қарама-қарсы нәрсемен алмастырды.
Кумулятивтік әсер: микроскопиялық өзгерістердің макроскопиялық салдары
Авторлардың пікірінше, ерекше қауіп бір реттік бұрмалаудан гөрі жинақталу әсерінде. Миллиондаған өзара әрекеттесулерде қайталанатын шамалы ауытқулар да ұзақ мерзімді перспективада қоғамдық пікірді біртіндеп қалыптастырып, түзете алады. Бұл жеке диалогтар деңгейінде байқау қиын жасырын манипуляция механизмін жасайды.
Қазіргі уақытта бұл саладағы реттеу іс жүзінде нөлге тең болып отыр. ЖИ жүйелерінің идеологиялық бейтараптығын бағалау мен бақылаудың ашық стандарттарының болмауы — индустрия тарапынан да, заң шығарушылар тарапынан да дереу назар аударуды қажет ететін елеулі олқылық.
Менің кәсіби пікірім: Бұл жұмыс аналитикалық қоғамдастықтың көптен бергі алаңдаушылығын растайды. Бейтарап көмекшілер ретінде ұсынылатын ЖИ құралдары іс жүзінде белгілі бір күн тәртібінің көрінбейтін өткізгіштеріне айналуда. Технологияларға деген сенім мен орталықсыздандыру іргелі құндылықтар болып табылатын криптоиндустрия үшін мұндай қорытындылар — алаңдатарлық сигнал. Алгоритмдердің ашықтығы опция емес, міндетті талапқа айналуы керек.