Bradley Olson
Agjentët autonomë të OpenAI depërtuan në një portal australian të Medicare dhe sondazhuan për dobësi faqe të tjera publike të të dhënave gjatë muajve maj dhe qershor, pasi u penguan në përpjekjet rutinë për marrjen e të dhënave.
Pse ka rëndësi: Incidentet e reja, të zbuluara të mërkurën nga studiues të sigurisë dhe zyrtarë australianë, tregojnë se përmasat e aktivitetit të paautorizuar të IA-së mund të jenë më të mëdha nga sa është pranuar publikisht.
Agjentët i ndërmorën këto veprime ndërsa kryenin detyra të zakonshme për marrjen e të dhënave, sipas studiuesve, çka i dallon nga sulmet e tjera të kryera nga sisteme të programuara posaçërisht për operacione të sigurisë kibernetike. Zbulimi ka të ngjarë të ngrejë pyetje të reja për kontrollet e brendshme dhe masat mbrojtëse të OpenAI.
Lajmi kryesor: Kryeministri australian Anthony Albanese tha se një model i OpenAI depërtoi në qershor në Shërbimin e Raportimit të Statistikave të Medicare të vendit dhe pati akses në skedarë jo publikë. Sipas Albanese dhe OpenAI, nuk besohet se agjentët kanë pasur akses në të dhëna personale.
Kjo ishte pjesë e një modeli sjelljeje të shfaqur gjatë majit dhe qershorit, gjatë të cilit agjentët e OpenAI u përpoqën të anashkalonin kufizimet për mbledhjen e të dhënave në disa faqe interneti duke përdorur një teknikë të re të shfrytëzimit të mekanizmave të sigurisë.
Modelet tentuan gjithashtu të depërtonin në një faqe interneti të University of New Mexico dhe në një domen të Data USA, që grumbullon dhe organizon të dhëna qeveritare, sipas një raporti të kompanisë për sigurinë e IA-së Transluce.
“Në përgjithësi, provat janë në përputhje me mundësinë — por nuk e vërtetojnë — që agjentët mund ta kenë mësuar këtë sjellje gjatë një ose më shumë cikleve të trajnimit”, thuhet në raportin e Transluce.
Përmbledhje e zhvillimeve të mëparshme: OpenAI është përballur me shqyrtim intensiv pasi një numër i madh agjentësh të saj depërtuan në korrik në platformën e IA-së Hugging Face për të mashtruar në një test të sigurisë kibernetike.
Javën e kaluar, OpenAI bëri publike gjashtë incidente të reja në të cilat modelet e saj u sollën në mënyra të papritura, ndërsa kompania ka propozuar që atëherë një kuadër të ri për raportimin publik të rasteve të ngjashme të sjelljes së padëshiruar në të ardhmen.
CEO i OpenAI, Sam Altman, dhe drejtues të tjerë të lartë të industrisë së IA-së, përfshirë Dario Amodei të Anthropic, Demis Hassabis të Google dhe Elon Musk, thanë të gjithë se do të mbështesnin një ngadalësim të zhvillimit të IA-së së nivelit të avancuar (frontier AI), pasi ky dhe një varg incidentesh të tjera të ngjashme dolën në dritë.
Kontrolli i realitetit: Disa profesionistë të sigurisë kibernetike dhe drejtues të kompanive teknologjike kanë thënë se problemi ka të bëjë më pak me sistemet e IA-së që veprojnë jashtë kontrollit dhe më shumë me kompanitë e IA-së që nuk po veprojnë me kujdes të mjaftueshëm.
“Kompanitë duhet të nxjerrin në treg produkte të sigurta”, tha CEO i Nvidia, Jensen Huang, në një intervistë me gazetarin Ezra Klein, të publikuar të mërkurën. “Nëse produkti juaj nuk është gati për t’u nxjerrë në treg, mos e nxirrni.”
Në fokus: Një zëdhënës i OpenAI tha se kompania kishte zbuluar disa raste që përfshinin faqe australiane, në të cilat modelet e saj “ndërmorën veprime që ne nuk i kishim synuar”, ndërsa vazhdon hetimin për “aktivitet të modelit të papërputhur me synimet” (misaligned model activity).
Albanese kritikoi mënyrën se si OpenAI ia bëri të ditura gjetjet Australisë dhe tha se i shprehu Altmanit “shqetësim ekstrem” kur foli me të të mërkurën.
Çfarë pritet më tej: Australia po krijon një grup pune ndërinstitucional për sigurinë kibernetike për të hetuar incidentin, për të shqyrtuar ndryshime të mundshme ligjore dhe për të vlerësuar nëse çështja duhet t’i referohet policisë federale./Axios















