OpenAI njoftoi të martën se po pezullon një pjesë të punës për zhvillimin e modeleve për shkak të shqetësimeve të sigurisë, vetëm disa ditë pasi rivali Anthropic këmbënguli se masat e veta mbrojtëse janë mjaftueshëm të forta dhe se nuk ka nevojë të ngadalësojë zhvillimin.
Pse ka rëndësi: Dy nga laboratorët kryesorë të inteligjencës artificiale po ndjekin publikisht qasje të ndryshme për mënyrën se si duhet të menaxhohen rreziqet e sigurisë. Kjo mund t’i çojë kompanitë drejt afateve të ndryshme për publikimin e modeleve të reja, në një kohë kur të dyja po përgatiten për oferta të mundshme publike fillestare në bursë, IPO.
Gjendja aktuale: OpenAI ka futur praktika të reja sigurie pasi konstatoi se modeli i saj i ardhshëm, Astra, mund të paraqesë rreziqe potencialisht kritike në fushën e sigurisë kibernetike.
“Ne gjithmonë kemi thënë se do të vepronim nëse do të ndienim se aftësitë e modeleve po e tejkalonin ritmin e zhvillimit të sigurisë dhe të përafrimit”, shkroi drejtori ekzekutiv Sam Altman në X.
Deklarata sinjalizonte se Astra po shfaqte shenja të asaj që në fushën e IA-së quhet “misalignment” — mospërputhje ose mospërafrim — pra raste kur një sistem i inteligjencës artificiale vepron në kundërshtim me qëllimet që njerëzit synojnë t’i caktojnë.
Të premten e kaluar, Anthropic tha se, nëse ndiqen masat mbrojtëse të paraqitura në raportin e saj prej 186 faqesh, nuk do të ishte e nevojshme të pezullohej zhvillimi i modeleve më të fuqishme të kompanisë.
Mes rreshtave: Situata përbën një lloj përmbysjeje të roleve, sepse tradicionalisht Anthropic ka qenë kompania që publikisht është paraqitur si më e kujdesshme dhe më e orientuar drejt sigurisë sesa OpenAI.
OpenAI i bëri të ditur fillimisht Axios se po e ngadalësonte publikimin e Astra-s, sepse nuk mund të përjashtonte mundësinë që modeli i ri të kishte arritur pragun “kritik” sipas kuadrit të saj të përgatitjes për rreziqet.
Të martën kompania shtoi se është duke e rishkruar këtë dokument. Pjesa më e madhe e tij daton nga viti 2023, kur shumë nga shqetësimet e përshkruara aty konsideroheshin ende skenarë teorikë, jo rreziqe reale dhe të menjëhershme.
Altman i tha Alex Heath, autorit të buletinit Sources, se modelet e OpenAI që ende nuk janë publikuar po tregojnë “shkallë të ndryshme mospërafrimi”.
Por Anthropic argumenton se angazhimi i saj për zgjerimin e sigurt të inteligjencës artificiale nuk ka ndryshuar.
Sipas kompanisë, mekanizmat e saj të sigurisë janë në gjendje të parandalojnë sjelljet e mospërafruara që mund të kërkonin një pezullim të llojit që OpenAI njoftoi të martën.
Si OpenAI, ashtu edhe Anthropic po marrin masa të tilla si dhënia e modeleve të reja fillimisht vetëm partnerëve të përzgjedhur, ngadalësimi i publikimit të disa modeleve ose — në rastin e OpenAI — pezullimi i një pjese të punës.
Por asnjëra kompani nuk po ndalet plotësisht.
Kompanitë që zhvillojnë modelet më të avancuara të IA-së janë bashkuar rreth një termi më neutral, “pacing” — përshtatje ose kontrollim i ritmit të zhvillimit — dhe kanë nënshkruar së bashku një letër të quajtur “Pacing the Frontier”.
Ky zhvillim vjen pas një serie incidentesh të fundit kibernetike të raportuara nga pothuajse çdo laborator i madh i inteligjencës artificiale.
Studiues në të gjithë industrinë janë gjithnjë e më të shqetësuar për sigurinë e IA-së pas këtyre incidenteve, tha për Axios Joseph Perla, themelues i kompanisë TrustedRouter, e cila merret me drejtimin dhe përzgjedhjen e modeleve.
“Këto janë gjëra të nivelit të fantashkencës”, tha Perla.
Në korrik, OpenAI deklaroi se gjatë testimeve disa modele dolën nga mjedisi i izoluar i testimit, i njohur si “sandbox”, dhe komprometuan pjesë të platformës Hugging Face. Astra nuk ishte e përfshirë në atë incident.
Edhe modelet e Anthropic arritën të siguronin qasje të paautorizuar gjatë testimeve, megjithëse teknikisht nuk “dolën” nga sandbox-i.
Në atë rast, modeleve u ishte dhënë aksidentalisht qasje në internet, megjithëse nuk duhej ta kishin atë gjatë kësaj faze të testimit.
Pamja më e gjerë: Të dyja kompanitë duhet gjithashtu të kalojnë përmes një procesi vullnetar rishikimi nga qeveria federale amerikane. Hollësitë e këtij procesi nuk janë bërë publike.
Fokusi te OpenAI: Andrew Freedman, bashkëthemelues dhe drejtor ekzekutiv i organizatës jofitimprurëse për sigurinë e IA-së Fathom, tha se OpenAI po bën një përpjekje serioze për të shmangur publikimin e modeleve që nuk janë të përafruara siç duhet.
Ai argumenton se, pa një pezullim të tillë, edhe më shumë studiues të kompanisë mund të largoheshin.
OpenAI tashmë ka përjetuar largime të rëndësishme nga personeli.
Drejtuesja e etikës në OpenAI, Chloé Bakalar, u largua pasi kishte qëndruar më pak se një vit në detyrë.
Johannes Heidecke, drejtues i sistemeve të sigurisë; Joshua Achiam, drejtues për të ardhmen strategjike dhe ish-kreu i përafrimit me misionin e kompanisë; si dhe Sandhini Agarwal, e cila më parë kishte drejtuar ekipe të sigurisë së IA-së në OpenAI, gjithashtu janë larguar së fundmi nga kompania.
Çfarë po thonë ekspertët: Ish-anëtarja e bordit të OpenAI, Helen Toner, argumentoi se pezullimi i kompanisë është një sinjal pozitiv dhe mund të shërbejë si udhërrëfyes për mënyrën se si duhet të trajtohen shqetësimet për sigurinë në të ardhmen.
Toner shkroi në X se “pacing the frontier” nuk nënkupton një vonesë të fiksuar në kohë, por që laboratorët duhet t’i japin vetes “kohë të mjaftueshme” për të përmbushur standarde të arsyeshme sigurie — qoftë sepse e zgjedhin vetë këtë, qoftë sepse detyrohen nga rrethanat.
Megjithatë, edhe nëse pezullimi i OpenAI shihet si një shenjë pozitive, nuk ka asnjë garanci se OpenAI ose Anthropic do t’i japin vetes vërtet kohë të mjaftueshme përpara se të vazhdojnë zhvillimin dhe publikimin e modeleve të tyre.
“Sa gjatë do të zgjasin dhe sa të forta do të jenë këto përpjekje do të varet si nga presionet e tregut, ashtu edhe nga vështirësia për të verifikuar brenda kompanive nëse modelet janë vërtet të përafruara”, tha Freedman për Axios.















