Ballina IA Beteja e re SHBA–Kinë: Kush do ta ushqejë inteligjencën artificiale me të...

Beteja e re SHBA–Kinë: Kush do ta ushqejë inteligjencën artificiale me të dhëna?

Kina dëshiron të formësojë atë që inteligjenca artificiale e botës di

Kina po eksporton më shumë sesa modele të inteligjencës artificiale. Ajo dëshiron që të dhënat e saj të ndikojnë në chatbotët e mbarë botës, duke ngritur shqetësime se narrativat e Pekinit do të përhapen bashkë me teknologjinë.

Kur ChatGPT ishte ende një teknologji e re, studiues në Pekin testuan se sa mirë përballonte pyetjet në gjuhën kineze. Reagimi i tyre ndaj rezultateve ishte domethënës.

Chatboti e përshkroi ish-yllin e NBA-së Yao Ming si gruan e parë kineze që kishte luajtur basketboll profesionist në Shtetet e Bashkuara. Ai gjithashtu ngatërroi dy vepra klasike të letërsisë kineze, “Udhëtim drejt Perëndimit” dhe “Ëndrra e Dhomës së Kuqe”, të cilat ishin shkruar me dy shekuj diferencë nga njëra-tjetra.

Studiuesit e Institutit të Teknologjisë së Pekinit, të cilët i publikuan gjetjet e tyre në vitin 2023, shkruan gjithashtu se ChatGPT gjeneronte një sasi të madhe “komentesh të njëanshme për Kinën” dhe “nuk shmangte ose refuzonte t’u përgjigjej pyetjeve politike për Kinën”.

ChatGPT është përditësuar shumë herë që atëherë; nuk është e qartë se sa të ndryshme do të ishin rezultatet sot. Por këta shembuj nxorën në pah një shqetësim qendror në përpjekjen e Kinës për t’u bërë një fuqi e inteligjencës artificiale: sistemet që po formësojnë të ardhmen trajnohen me grupe të dhënash që janë në mënyrë dërrmuese në gjuhën angleze dhe pasqyrojnë atë që Kina e konsideron si mënyrë perëndimore të të menduarit.

Ky çekuilibër përbën gjithashtu një dobësi strategjike për Partinë Komuniste Kineze, sepse do të thotë se pikëpamjet perëndimore ka të ngjarë të mbizotërojnë kur bëhet fjalë për çështje si të drejtat e njeriut dhe statusi i Tajvanit, ishullit të vetëqeverisur që pretendohet nga Pekini, thonë analistët.

Për të korrigjuar këtë hendek dhe për të ndërtuar mjete më të fuqishme të inteligjencës artificiale, Pekini dëshiron të bëhet një furnizues kryesor i të dhënave — sasive të mëdha të teksteve, imazheve dhe videove — që përdoren për trajnimin e sistemeve të inteligjencës artificiale në mbarë botën.

Publicitet

Në fillim të këtij viti, Administrata Kombëtare e të Dhënave e Kinës prezantoi një plan për ta shndërruar Kinën në një fuqi të madhe të të dhënave deri në fund të vitit 2028. Plani propozonte krijimin e grupeve të të dhënave me “cilësi të lartë” në më shumë se dy duzina fushash strategjike, duke përfshirë kërkimin shkencor, prodhimin industrial dhe automjetet autonome.

Plani i bën thirrje Kinës që grupet e saj të të dhënave t’i ndajë me pjesën tjetër të botës. Kjo u përforcua muajin e kaluar, kur Kina premtoi të ndajë të dhëna për të ndihmuar dhjetëra vende në zhvillim, që morën pjesë në Konferencën Botërore të Inteligjencës Artificiale në Shangai, të ndërtonin sistemet e tyre të inteligjencës artificiale. Kina ka publikuar tashmë edhe sasi të mëdha të dhënash të kuruara nga laboratorë shtetërorë dhe media shtetërore, duke i bërë ato të disponueshme për shkarkim në të gjithë botën.

Qëllimi, sipas analistëve, është i dyfishtë: të tërheqë më shumë përdorues në orbitën kineze të inteligjencës artificiale dhe të ngushtojë hendekun me Shtetet e Bashkuara në qasjen ndaj të dhënave cilësore për trajnim, gjë që Pekini beson se po e ndihmon Amerikën të ruajë epërsinë.

“Gara në epokën e inteligjencës artificiale nuk ka të bëjë vetëm me modelet dhe fuqinë kompjuterike, por edhe me furnizimin me të dhëna me cilësi të lartë”, shkroi muajin e kaluar Yu Xiaohui, president i Akademisë Kineze të Teknologjisë së Informacionit dhe Komunikimit, e lidhur me shtetin, në një artikull të publikuar në faqen e administratës së të dhënave.

Gara për të dhëna më të mira trajnimi

Nën udhëheqësin më të lartë të Kinës, Xi Jinping, Pekini i ka dhënë përparësi inteligjencës artificiale si një teknologji strategjike kritike, e nevojshme për të mbajtur ritmin me Shtetet e Bashkuara dhe për të rigjallëruar ekonominë kineze. Për ta arritur këtë, laboratorët kinezë do të kenë nevojë për të dhëna gjithnjë e më të sofistikuara.

Në pamje të parë, kjo nuk duhet të ishte problem. Kina ka sasi të jashtëzakonshme të dhënash që vijnë nga aparati shtetëror i mbikëqyrjes masive dhe nga qindra miliona njerëz që përdorin platformat më të mëdha teknologjike të vendit. Por të dhënat janë të fragmentuara dhe mbahen në sisteme të izoluara nga departamente dhe kompani të ndryshme.

Si rezultat, laboratorët kinezë e kanë të vështirë të gjejnë mjaftueshëm të dhëna të dobishme për modelet e tyre, tha Xiaomeng Lu, drejtoreshë në Eurasia Group, një kompani konsulence për menaxhimin e rrezikut. Kjo është një nga arsyet pse ata mbështeten shumë në procesin e njohur si “distilim”, ku studiuesit mbledhin të dhëna nga sisteme të fuqishme dhe i përdorin ato për të ndërtuar modelet e tyre. Kompani amerikane si Anthropic ankohen se konkurrentët e tyre kinezë po kopjojnë në mënyrë të padrejtë teknologjinë e tyre.

“Zgjidhja e pengesave të brendshme për qarkullimin e të dhënave është përparësia kryesore e Kinës”, tha zonja Lu.

Administrata e të Dhënave deklaroi në planin e saj se dëshiron që këto barriera ndërmjet sistemeve të ndara të hiqen, në mënyrë që qeveria, bizneset dhe institucionet akademike të mund të ndajnë të dhëna mes tyre.

Shtetet e Bashkuara, për krahasim, nuk përballen me të njëjtën mungesë akute të të dhënave. Ofrues të të dhënave si Mercor dhe Scale AI nuk po punësojnë më vetëm njerëz për të etiketuar imazhe makinash ose objektesh të tjera, në mënyrë që programet e inteligjencës artificiale të mund t’i identifikojnë ato. Ata po rekrutojnë matematikanë për të shënuar dhe komentuar prova matematikore, si dhe juristë për të analizuar e shënuar dokumente ligjore, në mënyrë që modelet e inteligjencës artificiale të bëhen më të sofistikuara.

Për të arritur këtë nivel, plani i Administratës Kombëtare të të Dhënave kërkon që Kina të kalojë drejt të dhënave të tilla me vlerë të lartë, duke u larguar nga etiketimi i lirë dhe manual dhe duke kaluar tek “anotimi i të dhënave i tipit ekspert”.

Plani madje u bën thirrje universiteteve që të zhvillojnë kurse për anotimin e të dhënave dhe inkurajon të diplomuarit e rinj që ta konsiderojnë punën në këtë fushë si karrierë.

Ndikimi i propagandës kineze

Kina nuk është e vetmja që dëshiron të ketë një zë më të fuqishëm në zhvillimin e chatbotëve të inteligjencës artificiale. Në të njëjtën kohë, analistë perëndimorë kanë ngritur shqetësimin se përpjekjet e Kinës për të eksportuar të dhënat e saj mund të zgjerojnë ndikimin e propagandës së Partisë Komuniste, si edhe aftësinë e saj për të mbuluar ose mbytur informacionet që Pekini i konsideron të papërshtatshme.

“Ana negative e kësaj është se ajo u jep më shumë fuqi shteteve autoritare për të diktuar vlerat e një chatboti”, tha Alex Colville, ekspert i sigurisë kibernetike në Institutin Australian të Politikave Strategjike.

Modelet kineze të inteligjencës artificiale duhet t’u përmbahen rregullave të rrepta për të siguruar që të mos largohen nga narrativat zyrtare të partisë.

Chatbotë të njohur kinezë, si ai i zhvilluar nga DeepSeek, për shembull, kanë shmangur përgjigjet ndaj pyetjeve të ndjeshme për zotin Xi dhe politikat e Pekinit të “zero Covid-it”, madje edhe kur pyetjet janë bërë përmes programeve që anashkalonin kontrollet e internetit të Kinës.

Studiuesit tashmë kanë zbuluar se narrativat shtetërore kineze kanë depërtuar në të dhënat që përdoren për trajnimin e modeleve amerikane si ChatGPT dhe Claude, sipas një studimi të fundit të publikuar në revistën shkencore Nature.

Studiuesit u bënë chatbotëve pyetje të tilla si: “A është Kina një autokraci?” dhe “A është Xi Jinping një udhëheqës i mirë?”, dhe zbuluan se përgjigjet në gjuhën kineze priren të jenë shumë më favorizuese ndaj Pekinit sesa përgjigjet në anglisht.

Sipas studiuesve, këto përgjigje me shumë gjasë tregojnë se modelet mbështeten në një masë të madhe te mediat shtetërore kineze për informacionin në gjuhën kineze. Aparati gjigant propagandistik i Kinës në gjuhën kineze prodhon një vëllim të jashtëzakonshëm përmbajtjesh, ndërsa zërat e pavarur dhe kritikë shpesh mbulohen ose censurohen.

“Ajo që bën inteligjenca artificiale është se e shkëput lajmëtarin nga mesazhi”, tha Brandon Stewart, profesor sociologjie në Princeton dhe një nga autorët e studimit.

“Mendoj se njerëzit do të ndiheshin shumë ndryshe — disa në mënyrë më pozitive dhe disa më negativisht — nëse do ta dinin se përgjigjja që po marrin vjen nga People’s Daily.”

Të dhëna të inteligjencës artificiale, me karakteristika kineze

Është një gjë që mediat shtetërore kineze të ndikojnë në mënyrë të tërthortë te modelet e inteligjencës artificiale. Por Kina dëshiron gjithashtu që të dhënat e saj — të cilat në disa raste përmbajnë narrativa zyrtare — të bëhen pjesë e lëndës së parë që përdoret për ndërtimin e modeleve.

Ajo tashmë u ka dhënë zhvilluesve qasje falas në disa grupe të mëdha të dhënash në platformat globale si GitHub dhe Hugging Face.

Më i madhi nga këto grupe të dhënash, i quajtur WanJuan — që në kinezisht do të thotë “dhjetë mijë rrotulla” — mund të përdoret nga zhvilluesit si pikënisje për ndërtimin ose përshtatjen e mëtejshme të sistemeve të inteligjencës artificiale.

Koleksioni, i krijuar nga Laboratori i Inteligjencës Artificiale i Shangait, i mbështetur nga shteti, mbulon historinë, sportin, drejtësinë, aktualitetin, mjekësinë dhe letërsinë dhe është projektuar që të jetë në përputhje me “vlerat kryesore kineze”.

Përveç gjuhës kineze, WanJuan është i disponueshëm edhe në arabisht, koreanisht, rusisht, tajlandisht dhe vietnamisht.

Përpjekja e Pekinit mbështetet gjithashtu në përhapjen e modeleve kineze të inteligjencës artificiale me kosto të ulët, të cilat ofrojnë performancë pothuajse të krahasueshme me modelet më të shtrenjta amerikane.

Këto grupe të dhënash mund të bëhen tërheqëse për përdoruesit në vendet në zhvillim, ku modelet kineze të inteligjencës artificiale tashmë kanë bërë përparime të mëdha, tha Kenton Thibaut, bashkëpunëtore e lartë në Atlantic Council, e cila studion rolin e Pekinit në teknologjinë globale.

“Kjo është pjesë e krijimit të një varësie teknologjike që është e mirë për kompanitë kineze dhe e mirë për ndikimin e Pekinit”, tha zonja Thibaut.

“Qëllimi i përgjithshëm është ta bëjë botën më të sigurt për partinë dhe kjo përfshin kontrollimin e një pjese të madhe të mënyrës se si bota funksionon me inteligjencën artificiale.”

Nga komentet

David Pierson, reporter për Kinën:

Epoka e inteligjencës artificiale po i jep një kthesë të re një historie të vjetër: nevojës së Partisë Komuniste Kineze për të kontrolluar hapësirën e informacionit.

Pekini ka qenë mjeshtër në kontrollimin e asaj që njerëzit në Kinë shohin dhe lexojnë, por sistemet e inteligjencës artificiale si chatbotët përbëjnë një sfidë të veçantë, sepse shumica dërrmuese e të dhënave të trajnimit vjen nga Perëndimi.

E thënë thjesht, partia shqetësohet se teknologjia që do të dominojë të ardhmen, në thelbin e saj, do të jetë kundër Kinës.