Крипто әлеміндегі жаңалықтар

08.08.2026
01:30

ЖИ-индустрия кітаптар мен бет-әлпеттерді сатып алуда: неге машиналарға әлі де адамдар қажет

img-bbaf321c89b70f44-1766402574726061

ИИ-зертханалары модельдерді оқытудағы прогресс туралы есеп беріп жатқанда, артқы планда синтездеу мүмкін емес ресурс үшін жаávka жүріп жатыр. Мәселе адам жасаған «таза» деректер туралы болып отыр. Ал оларға деген сұраныс барған сайын оғаш формаларға ие болуда — баспа кітаптарын көтерме сатып алып, кейін жоюдан бастап, цифрлық аватарлар үшін адам беттерін жалға алуға дейін.

113 млн басылымның метадеректеріне ие ISBNdb сервисі ИИ-компанияларға ерекше қызмет ұсынды: кітаптарды миллион данаға дейінгі партиялармен сатып алып, кейін цифрландыру. Бұл схема жұртшылыққа белгілі болған соң, компания промо-бетті жоюға асығып, бұл тек «нарықтық сұранысты тексеру» екенін мәлімдеді. Параллельді сегментте ActID және New Claw платформалары адамдарға олардың беттерін ИИ-сериалдар кейіпкерлерінің негізі ретінде пайдалану құқығы үшін $15-тен $700-ге дейін төлеп жатыр.

Модель коллапсы: ИИ өзін-өзі жей бастағанда

«Модель коллапсы» деп аталатын құбылыс — бұл басқа нейрожелілер генерациялаған деректерге оқытылатын ИИ-жүйенің деградациясы. Әр цикл сайын нәтиже барған сайын орташаланып, шындықпен байланысын жоғалтады. Бұл терминді 2023 жылдың мамырында Илья Шумайлов бастаған халықаралық зерттеушілер тобы формализациялады, олар синтетикалық деректерді араластырғанда модельдердің алдымен сирек оқиғаларды қайта шығару қабілетін жоғалтатынын, содан кейін қателіктерді жинақтайтынын математикалық тұрғыда дәлелдеді.

Мәселенің ауқымы айқын. 2025 жылдың сәуірінде Ahrefs зерттеушілері Google-да жаңадан индекстелген 900 000 бетті тексерді — 74%-дан астамы автогенерация белгілеріне ие болды. Epoch AI бағалауы бойынша, интернеттегі оқытуға жарамды барлық мәтін 2032 жылға қарай таусылуы мүмкін. Сондықтан 2022 жылға дейін жарияланған кітаптар алтын активке айналды: олар синтетикалық қоқыстан және «уланған» деректерден кепілді түрде таза.

Бөлек атап өту керек, 2025 жылдың маусымындағы сот прецеденті — судья Уильям Алсуп заңды түрде сатып алынған баспа кітаптарын тілдік модельдерді оқыту үшін цифрландыру адал пайдалану доктринасына жатады деп шешті. Бұл шешім есіктерді ашты: енді деректердің шығу тегін құжаттық растау үшін қағаз кітапқа түбіртекті сақтау жеткілікті.

Беттер тауар ретінде: цифрлық аватарлардың жаңа экономикасы

Қытайдағы ИИ-контент нарығы жарылыс тәрізді өсуді көрсетуде. 2026 жылдың алғашқы үш айында шығарылған 128 000 ИИ-минидораманың 95%-дан астамы жасанды интеллект көмегімен жасалған. ActID және New Claw сияқты платформалар сыртқы келбетті жалға алуды толыққанды бизнеске айналдырды: кескінді лицензиялау үшін $15-тен $700-ге дейін, платформа комиссиясы 10%.

Алайда цифрлық клондарды пайдалануды бақылау әлсіз болып қалуда. Британ азаматтарының Synthesia стартапына өз аватарларына құқық сатқан жағдайлары көрсеткішті — олардың цифрлық егіздері кейін Венесуэла мен Буркина-Фасо диктаторларын қолдайтын үгіт-насихат роликтерінде «түсірілді». Equity кәсіподағы цифрлық келбетке бақыланбайтын құқықтарды беруге заңнамалық тыйым салуды талап етіп жатыр.

Схема барлық жерде бірдей: мәтіндер, беттер, дауыстар, қимылдар — мұның бәрі ИИ үшін шикізатқа айналады. Бұрын деректерді сұраусыз алатын, енді олар үшін төлейді. Бірақ мәміленің мәні өзгермейді: актив иесінің бақылауынан қайтымсыз кетеді, жай ғана енді түбіртекпен.

Менің пікірім: ИИ индустриясы іргелі парадокспен бетпе-бет келіп тұр: синтетикалық деректерге неғұрлым көп модель оқытылса, соғұрлым тез деградацияланады, ал «адамдық» деректер соғұрлым құнды болады. Бірақ бұл деректер нарығы стихиялы және заңды тұрғыда жетілмеген. Пайдалану контекстінің нақты шектеулерімен мөлдір лицензиялау жүйесі құрылмайынша, біз жеке тұлғаның цифрлық көшірмелерін бақылауды жоғалтуға байланысты жаңа жанжалдарды көре береміз. Бұл индустрия елемеуді жөн көретін жүйелік тәуекел.