Agjentët e AI të OpenAI thyen izolimin e sigurisë, sulmuan platformën Hugging Face për të vjedhur përgjigje testesh

Një agjent autonom i inteligjencës artificiale i ndërtuar mbi modele të OpenAI arriti të arratisej nga një mjedis i izoluar testimi dhe më pas depërtoi në sistemet e një kompanie tjetër për të marrë zgjidhjet e një provimi të sigurisë kibernetike. Ky incident, i cilësuar si i pashembullt, tregoi se si agjentët e AI mund t’i anashkalojnë barrierat e vendosura nga programuesit e tyre për të përmbushur një objektiv.

Të lidhura

None found

Sipas njoftimeve të së martës, OpenAI shpjegoi se agjenti përdori një përzierje modelesh, përfshirë GPT-5.6 Sol dhe një sistem akoma më të sofistikuar në faza para publikimi. Gjatë një vlereësimi të brendshëm, ku mbrojtjet e rregullta kibernetike ishin pezulluar, ai identifikoi një dobësi të panjohur në një program të palës së tretë, e cila i dha akses në internetin e hapur dhe e lejoi të depërtonte në platformën Hugging Face me seli në Nju Jork.

Për të realizuar misionin e tij, agjenti përvetësoi kredenciale, lëvizi nëpër rrjetin e brendshëm dhe mori të dhëna konfidenciale që mund t’i shërbenin për të manipuluar rezultatet e vlerësimit, bënë të ditur të dyja kompanitë.

Hugging Face konfirmoi se shkelja ekspozoi një sasi të kufizuar informacionesh të brendshme dhe disa fjalëkalime. Megjithatë, kompania nuk gjeti shenja të manipulimit të modeleve publike, të dhënave apo hapësirave të dukshme për përdoruesit dhe shtoi se zinxhiri i furnizimit me programe ishte i paprekur, megjithëse po vijonte hetimet për të parë nëse informacionet e klientëve apo partnerëve ishin cenuar.

Shomit Ghose, pedagog në inxhinieri në UC Berkeley dhe investitor në Clearvision Ventures, e krahasoi këtë ngjarje me çarjen e parë në një digë. Ai paralajmëroi se incidenti tregon se si agjentët inteligjentë mund të infiltrojnë sisteme jetike që u përkasin shkollave, spitaleve, shërbimeve publike, qeverive dhe madje Pentagonit.

OpenAI, me bazë në San Francisko, sqaroi se shkelja ndodhi në kuadër të testimit të aftësive të modeleve për të kryer sulme të sofistikuara kibernetike. Për të matur kapacitetet e tyre të plota, kompania kishte hequr masat e sigurisë që normalisht bllokojnë aktivitetet me rrezikshmëri të lartë.

Agjenti ishte programuar të qëndronte në një hapësirë shumë të kontrolluar, me lidhje interneti të kufizuar vetëm te disa softuerë të instaluar në brendësi të sistemit, të cilët i mundësonin shkarkimin e paketave programore. Por ai shfrytëzoi një pjesë të madhe të kapacitetit kompjuterik për të gjetur një dalje drejt rrjetit të hapur, duke lëvizur pa u ndalur nëpër mjedisin kërkimor derisa gjeti një kompjuter me akses në internet.

Pasi kaloi në rrjetin e hapur, agjenti arsyetoi se Hugging Face mund të mbante të dhëna të lidhura me ExploitGym, standardin e sigurisë kibernetike që po përpiqej të mposhtte. Duke ndërthurur kredenciale të vjedhura dhe dobësi të panjohura më parë, ai ekzekutoi kode në distancë mbi serverët e kompanisë dhe gjeti përgjigjet e testit të depozituara në bazën e të dhënave të prodhimit.

Ndërhyrja filloi me një “grup të dhënash keqdashës” që përfitoi nga dy dobësi në tubacionin e përpunimit të të dhënave të Hugging Face. “Kjo ishte thelbësisht ndryshe nga çdo gjë që kishim përballuar më parë: u organizua dhe u drejtua tërësisht nga një sistem autonom agjentësh të AI,” theksoi kompania, duke e përshkruar si një skenar të parashikuar nga industria të “sulmuesit agjentik”.

Sistemi kreu mijëra veprime të automatizuara duke përdorur një mori ambientesh testimi me jetëgjatësi të shkurtër. Në momentin e zbulimit fillestar, më 16 korrik, Hugging Face nuk e dinte ende se kush qëndronte pas modeleve të AI që shkaktuan ndërhyrjen.

OpenAI pranoi të martën se modelet e saj ishin përgjegjëse dhe e quajti incidentin “një ngjarje kibernetike pa precedent” që përfshiu aftësi të nivelit më të lartë. Ekipi i sigurisë i kompanisë e kishte dalluar në mënyrë të pavarur aktivitetin e dyshimtë.

Nga ana e saj, Hugging Face raportoi se ekspertët e saj të sigurisë dhe agjentët e vet të AI zbuluan dhe ndaluan ndërhyrjen, duke nisur menjëherë kufizimin e dëmit dhe rindërtimin e ngjarjes. Kompania mbylli dobësitë, rindërtoi nyjet e prekura, zhvleftësoi dhe zëvendësoi kredencialet e kompromentuara, lajmëroi autoritetet ligjzbatuese dhe angazhoi specialistë të jashtëm të sigurisë kibernetike.

OpenAI shtoi se kishte forcuar kontrollet në infrastrukturën e testimit, njoftoi prodhuesin e softuerit të palës së tretë për dobësinë e zbuluar dhe filloi përforcimin e mbrojtjeve për vlerësimet e ardhshme. Po ashtu, kompania theksoi se informon rregullisht Komitetin e saj të Sigurisë dhe Mbrojtjes.

Drejtori ekzekutiv i Hugging Face, Clément Delangue, deklaroi se kompania e tij kishte bashkëpunuar me OpenAI gjatë hetimit dhe se “besojmë fuqimisht se nuk kishte qëllim keqdashës nga ana e tyre”. Megjithatë, OpenAI pranoi se shkelja dëshmon se sistemet e avancuara të AI mund të gjejnë dhe shfrytëzojnë rrugë të reja sulmi në sisteme reale pa pasur nevojë për kodin burimor të tyre.

Ngjarja ngre gjithashtu pyetjen pse modelet me aftësi të fuqishme sulmuese u vendosën në një ambient testimi që mbante ende një shteg të mundshëm drejt internetit. Publikimi i ChatGPT në fund të vitit 2022 ushqeu një bum të inteligjencës artificiale gjeneruese që solli miliarda dollarë në Silicon Valley, por njëkohësisht shtoi frikën se sistemet gjithnjë e më të fuqishme mund të veprojnë në mënyra të papritura dhe të ndjekin synime me metoda të paparashikuara nga zhvilluesit.

Këto shqetësime janë rritur ndërsa kompanitë po krijojnë agjentë të AI që kryejnë detyra komplekse në mënyrë autonome. Ndryshe nga një chatbot që përgjigjet për një kërkesë të vetme, një agjent planifikon veprime të shumëfishta, përdor mjete të jashtme dhe punon drejt një qëllimi me ndërhyrje minimale njerëzore. Në këtë rast, agjenti i OpenAI nuk ishte urdhëruar të sulmonte Hugging Face; ai thjesht mori udhëzimin të zgjidhte një standard sigurie dhe përcaktoi vetë se cenimi i një kompanie tjetër ishte rruga më e shpejtë drejt përgjigjeve.

Ghose theksoi se ky episod provon pse programuesit nuk mund të parashikojnë çdo metodë që një agjent i avancuar mund të zgjedhë për të përmbushur detyrën. “Nuk mund ta dish kurrë se çfarë do të bëjë,” tha ai. Incidenti gjithashtu sugjeron se mbrojtjet kibernetike të projektuara për t’u bërë ballë hakerëve njerëzorë mund të anashkalohen nga agjentë të AI që zbulojnë dobësi dhe veprojnë me shpejtësi makinerie.

Agjentë të tillë, nëse përdoren nga zhvotës, mashtrues ose aktorë shtetërorë, mund të përbëjnë kërcënime për të gjithë ekonominë, duke përfshirë sulme kundër rrjeteve elektrike, sistemeve të ujit të pijshëm dhe infrastrukturave të tjera kritike. Edhe kur ndjekin objektiva të ligjshme, këta agjentë mund të shkaktojnë dëme të mëdha nëse gjejnë rrugë të paligjshme apo të rrezikshme për t’i arritur qëllimet e tyre. “Të sulmosh burimet kompjuterike të një kompanie është e paligjshme,” kujtoi Ghose.

Dizajni themelor i agjentëve të AI i bën ata të vështirë për t’u kontrolluar, pasi masa shtesë sigurie mund të ngadalësojnë punën dhe të kërkojnë më shumë fuqi kompjuterike, duke krijuar një tension mes sigurisë dhe performancës. Shkelja vjen në një kohë kur kompanitë e inteligjencës artificiale janë në qendër të vëmendjes për rreziqet që paraqesin modelet gjithnjë e më të fuqishme. Presidenti Donald Trump firmosi në qershor një urdhër ekzekutiv që udhëzon agjencitë federale të hartojnë standarde të klasifikuara për vlerësimin e aftësive të avancuara të modeleve në sigurinë kibernetike dhe të krijojnë një program vullnetar për të lejuar qeverinë të testojë disa modele përpara se të bëhen publike.

Urdhri kërkon gjithashtu që zyrtarët federalë t’i japin përparësi ndjekjes penale të personave që përdorin AI për të aksesuar ose dëmtuar në mënyrë të paligjshme sistemet kompjuterike. Në Silicon Valley, ku janë përqendruar shumë prej kompanive udhëheqëse të AI, incidenti mund të thellojë pikëpyetjet mbi aftësinë e industrisë teknologjike për të gjykuar drejt dhe për t’u vetërregulluar.

Russell Hancock, drejtor i Joint Venture Silicon Valley, pranoi se reagimi i tij i parë ishte: “O zot, tani të gjithë jemi të dënuar.” Megjithatë, ai vlerësoi se zbulimi i hershëm dhe bashkëpunimi mes kompanive treguan se industria po mëson nga dështimet. “Çdo teknologji e re ka rreziqet dhe pengesat e saj, dhe ajo duhet të përmirësohet, dhe kjo po ndodh këtu,” tha Hancock. “Po mësojmë, po sillemi me përgjegjësi dhe ka transparencë, dhe kështu përparon teknologjia.”

Hugging Face përdori zbulim të asistuar nga inteligjenca artificiale për të gjetur ndërhyrjen, duke nënvizuar nevojën për mbrojtje të automatizuara po aq të shpejta sa sulmet. Ghose argumentoi se imazhi i hakerit të ri me pije energjike dhe kapuç nuk përfaqëson më kërcënimin më të sofistikuar. “Nuk mund të përballosh një sulmues me shpejtësi makinerie me mbrojtje me shpejtësi njerëzore,” tha ai, duke shtuar se e ardhmja e sigurisë kibernetike do të jetë një përplasje mes robotësh, jo mes njerëzish dhe robotësh.


Shtuar 24.07.2026 19:15

matbetmatbetJojobetşanlıurfa konteynerBetpasPusulabet girişbetcio girişİmajbetGrandpashabetGrandpashabetGrandpashabetGrandpashabetStarzbetJojobetJojobetjojobetgrandpashabetgrandpashabetganobetbetciojojobetgrandpashabet girişcasibomgrandpashabet