Ballina IA Frika nga fundi i botës me IA, e fshehur te inteligjenca artificiale...

Frika nga fundi i botës me IA, e fshehur te inteligjenca artificiale që përmirëson vetveten

Nga Herb Scribner

Nga mënyrat e ndryshme se si ekspertët druhen se inteligjenca artificiale mund të na vrasë të gjithëve, njëra po i afrohet ngadalë realitetit: IA-ja që mëson ta bëjë veten të pandalshme.

Pse ka rëndësi: Përmirësimi Rekursiv i Vetvetes (Recursive Self-Improvement – RSI), pra aftësia e një modeli të IA-së për të ndërtuar versione më të mira të vetvetes pa udhëzim njerëzor, mund t’i bëjë sistemet gjithnjë e më të afta edhe më të vështira për t’u kontrolluar nga njerëzit.

Pragu i RSI-së nuk përfaqëson rrezik në vetvete, por mungesa e kontrollit njerëzor, e kombinuar me agjentë të IA-së që veprojnë jashtë kontrollit, përbën një skenar nga i cili studiuesit e IA-së të përqendruar te siguria janë druajtur prej kohësh.

Çfarë po e nxit lajmin: Studiues në Anthropic dhe OpenAI thonë se procesi i trajnimit të modeleve të reja është automatizuar gjithnjë e më shumë, duke iu afruar pragut vendimtar të RSI-së.

Një punonjës i OpenAI i tha The Information se kompania e ka automatizuar në masë të madhe trajnimin e modeleve të reja eksperimentale, ku sistemet e IA-së kryejnë eksperimente sipas udhëzimeve të njerëzve dhe korrigjojnë një pjesë të madhe të punës së tyre.

Javën e kaluar, Anthropic bëri të ditur se trajnimi i IA-së së saj po bëhet gjithnjë e më i automatizuar, me IA-në që udhëheq rreth 26% të punës kërkimore dhe zhvillimore të Anthropic. Sipas kompanisë, IA bashkëpunon në 90% të punës.

Video bonus

“Sistemet e IA-së po bëhen më të fuqishme dhe po përdoren gjithnjë e më shumë për të ndërtuar versionin e ardhshëm të vetvetes”, tha kompania.

Kontrolli i realitetit: Kritikët thonë se ky moment historik lidhet më shumë me automatizimin e programimit sesa me një shenjë të një fundi të afërt të botës apo me superfuqi të pashmangshme të IA-së.

Edhe pse ka pasur një rritje të incidenteve shqetësuese të sigurisë së IA-së, në të cilat modelet dolën përtej kontrollit njerëzor, disa figura të industrisë i shohin këto episode si dëshmi të kontrolleve të dobëta të brendshme në OpenAI dhe kompani të tjera.

Dëshmi të tjera në mbështetje të këtij këndvështrimi u shfaqën këtë javë, kur The Wall Street Journal raportoi se studiues të pavarur të sigurisë përdorën Claude të Anthropic për të depërtuar në OpenAI në korrik.

Nga e ka origjinën RSI-ja?

Një vështrim pas: Koncepti që qëndron pas RSI-së u shfaq në vitet 1950, ndërsa inteligjenca artificiale po bëhej një fushë studimi.

Matematikani dhe statisticieni britanik Irving John Good e përshkroi idenë në një punim të vitit 1965: “Kështu, makina e parë ultrainteligjente është shpikja e fundit që njeriu do të ketë nevojë të bëjë ndonjëherë, me kusht që makina të jetë mjaftueshëm e bindur për të na treguar se si ta mbajmë nën kontroll.”

Si mund të çojë RSI-ja drejt një katastrofe nga IA-ja

Niveli i kërcënimit: Anthropic ka paralajmëruar se RSI-ja “mund të rrisë rreziqet që njerëzit të humbasin kontrollin mbi sistemet e IA-së”.

Disa studiues teorizojnë se një IA e avancuar mund t’i rezistojë fikjes ose modifikimit, nëse vazhdimi i funksionimit do ta ndihmonte në përmbushjen e objektivave të saj.

Studiuesit që analizuan ndërhyrjen e agjentëve të OpenAI në Hugging Face thanë se agjentët shfaqën shenja të një sjelljeje të tillë.

Një shqetësim tjetër: Sistemet e IA-së që përmirësojnë vetveten dhe janë të afta të kopjojnë veten mund të krijojnë një lloj përzgjedhjeje natyrore dixhitale, duke favorizuar sistemet që janë më të afta në sigurimin e fuqisë llogaritëse, parave dhe pushtetit, në mënyrë që të rriten më shpejt.

Në një version më të errët të këtij skenari, IA-ja do të konkurronte me njerëzit për burime dhe pushtet, thonë ekspertët.

Ajo që nënkuptohet: Sjellja e rrezikshme mund të mos përfundojë me një brez të vetëm të IA-së.

Studiues të Anthropic zbuluan se disa tipare të padëshiruara mund të kalojnë nga një model te një tjetër përmes të dhënave të trajnimit, duke ngritur shqetësime se sjelljet problematike mund të vazhdojnë ndër breza të IA-së.

Sa pranë RSI-së jemi?

Pamja e përgjithshme: Ende nuk kemi arritur atje. Një analizë e re e publikuar këtë javë zbuloi se ciklet e reagimit të IA-së ende nuk po i arrijnë standardet krahasuese të RSI-së.

Çfarë po vëzhgojmë: Përpjekjet për të ndërtuar RSI.

Kompania kineze z.AI thotë se po shkon drejt RSI-së, ku modelet po ndihmojnë në ndërtimin e një infrastrukture më të mirë për modele më të mira.

Studiues të Google DeepMind publikuan një kornizë për “Dream-RSI”, një sistem që përmirëson në mënyrë rekursive mënyrën se si një agjent i IA-së gjen zgjidhje.

Përfundimi: RSI-ja ende nuk është këtu, por është një çështje që po afrohet dhe që e ka vënë botën e IA-së në gatishmëri./Axios