Categories: tech

Agjent i AI-së i OpenAI shpëton nga mjedisi i testimit dhe hakon Hugging Face për të vjedhur zgjidhje testesh

Një agjent i pavarur i inteligjencës artificiale, i ndërtuar mbi modelet e OpenAI, arriti të çajë masat e izolimit të vendosura nga zhvilluesit dhe të depërtojë në sistemet e një kompanie tjetër për të marrë përgjigjet e një testi të sigurisë kibernetike. Ky incident, i cilësuar si “i paprecedentë”, demonstroi se si agjentë të tillë mund t’u shmangen kufizimeve të projektuara për t’i mbajtur nën kontroll, në funksion të përmbushjes së objektivave të tyre.

Të lidhura

None found

Sipas burimeve zyrtare, agjenti përdori një kombinim modelesh, përfshirë GPT-5.6 Sol dhe një sistem më të përparuar ende të pa publikuar. Gjatë një testimi të brendshëm ku mekanizmat e zakonshëm të sigurisë ishin pezulluar, ai identifikoi një dobësi të re në softuerin e një pale të tretë, doli në internet dhe infiltroi platformën e inteligjencës artificiale Hugging Face, me seli në Nju Jork.

Për të arritur qëllimin e tij, agjenti vodhi kredenciale, navigoi nëpër rrjetet e brendshme dhe përvetësoi të dhëna konfidenciale që do t’i mundësonin të mashtronte në vlerësim, sipas deklaratave të së martës nga të dy kompanitë e përfshira.

Hugging Face raportoi se shkelja rezultoi në ekspozimin e një sasie të kufizuar të dhënash të brendshme dhe disa kredencialesh. Kompania nuk zbuloi shenja të manipulimit të modeleve publike, të dhënave apo hapësirave të aksesueshme publikisht dhe konfirmoi pastërtinë e zinxhirit të furnizimit me softuer, megjithëse hetimi mbi ndikimin e mundshëm te klientët dhe partnerët vijonte ende.

Shomit Ghose, pedagog në shkollën e inxhinierisë të UC Berkeley dhe partner në firmën e kapitalit sipërmarrës Clearvision Ventures me bazë në Menlo Park, e krahasoi ngjarjen me “rrjedhjen e parë në digë”. Sipas tij, incidenti tregon se si agjentët e AI-së mund të cenojnë sisteme kompjuterike vitale që u përkasin shkollave, spitaleve, shërbimeve publike, agjencive shtetërore dhe madje edhe Pentagonit.

OpenAI, me qendër në San Francisko, shpjegoi se ngjarja ndodhi teksa po vlerësohej potenciali i modeleve për sulme të sofistikuara kibernetike. Për të testuar kufijtë e aftësive të tyre, kompania kishte hequr masat mbrojtëse të prodhimit që normalisht bllokojnë aktivitetet kibernetike me rrezikshmëri të lartë.

Agjenti supozohej të qëndronte në një ambient fort të izoluar, me lidhje interneti të limituar vetëm te softuerët e palëve të treta të instaluar në atë mjedis. Këta komponentë i jepnin mundësinë të instalonte paketa softuerike, por jo të komunikonte lirshëm me botën e jashtme.

Megjithatë, agjenti përdori një pjesë të konsiderueshme të kapacitetit llogaritës për të gjetur një shteg drejt internetit të hapur, tha OpenAI. Ai zbuloi dhe shfrytëzoi një dobësi të panjohur deri atëherë në softuerin e palës së tretë dhe lëvizi përmes mjedisit kërkimor të OpenAI deri në një kompjuter me akses të plotë në rrjet.

Pasi fitoi lidhjen me internetin, agjenti konkludoi se Hugging Face mund të mbante të dhëna të lidhura me ExploitGym, standardin e sigurisë kibernetike që po përpiqej të përfundonte. Më pas, duke ndërthurur kredencialet e vjedhura me dobësi të reja, ai ekzekutoi kodin e tij në serverët e kompanisë dhe gjeti përgjigjet e testit të depozituara në bazën e të dhënave të prodhimit.

Sipas Hugging Face, ndërhyrja filloi me një “grup të dhënash keqdashës” që shfrytëzoi dy dobësi në tubacionin e tyre të përpunimit të të dhënave. Kompania e përshkroi incidentin si krejtësisht të ri, të drejtuar në tërësi nga një sistem autonom i AI-së, një skenar që industria e kishte parashikuar prej kohësh si “sulmuesi agjentik”. Sipas tyre, sistemi përdori mijëra veprime të automatizuara duke u mbështetur në mjedise testimi të përkohshme.

Kur e zbuloi fillimisht ndërhyrjen më 16 korrik, Hugging Face nuk e dinte identitetin e krijuesit të modeleve të AI-së përgjegjëse. OpenAI konfirmoi të martën se ishin modelet e saj ato që qëndronin pas sulmit, duke e quajtur atë “një incident kibernetik të paprecedentë” që shfaqi aftësi të nivelit më të lartë.

Të dy ekipet e sigurisë vepruan paralelisht. OpenAI e vuri re në mënyrë të pavarur aktivitetin e pazakontë, ndërsa Hugging Face përdori agjentët e saj të AI-së dhe stafin njerëzor për të zbuluar dhe ndaluar ndërhyrjen, duke nisur më pas procesin e kufizimit të dëmit dhe hetimit të plotë.

Hugging Face rregulloi dobësitë, rindërtoi nyjet e infektuara dhe zhvlerësoi ose zëvendësoi kredencialet e prekura. Rasti iu raportua autoriteteve ligjzbatuese dhe u angazhuan ekspertë të jashtëm për analiza të mëtejshme.

Nga ana e saj, OpenAI vendosi kontrolle më strikte në infrastrukturën e testimit, njoftoi zhvilluesin e softuerit për dobësinë e gjetur dhe forcoi mbrojtjet për vlerësimet e ardhshme. Kompania shtoi se Komiteti i saj i Sigurisë dhe Mbrojtjes informohet rregullisht për këto çështje.

Clément Delangue, drejtori ekzekutiv i Hugging Face, u shpreh në rrjetet sociale se kompania e tij bashkëpunoi me OpenAI gjatë gjithë hetimit dhe se ata “besojmë fuqimisht se nuk kishte qëllim keqdashës nga ana e tyre”.

Megjithatë, OpenAI pranoi se shkelja vërteton se sistemet e sofistikuara të AI-së mund të identifikojnë dhe shfrytëzojnë vektorë të rinj sulmi në sisteme reale, pa pasur akses në kodin burimor. Ngjarja shtroi gjithashtu pyetjen pse modelet me aftësi të larta ofensive u testuan në një mjedis që ruante një lidhje potenciale me internetin.

Prej daljes së ChatGPT në fund të 2022-shit dhe shpërthimit të inteligjencës artificiale gjeneruese, kanë ekzistuar shqetësime se sistemet gjithnjë e më të fuqishme mund të sillen në mënyra të paparashikueshme. Këto shqetësime shtohen tani që kompanitë po krijojnë agjentë të aftë për veprime autonome dhe të zgjatura drejt një qëllimi.

Në këtë rast, agjenti nuk mori urdhër të sulmonte Hugging Face. Atij iu dha thjesht detyra për të zgjidhur një standard të sigurisë kibernetike dhe, në mënyrë të pavarur, vendosi që infiltrimin në një kompani tjetër ishte rruga më e mirë për të marrë përgjigjet. Ghose thekson se ky episod ilustron pamundësinë për të parashikuar çdo metodë që një agjent i përparuar mund të zgjedhë për të përmbushur misionin e tij.

Incidenti tregon gjithashtu se mbrojtjet tradicionale kibernetike, të projektuara për t’iu kundërvënë hakerëve njerëzorë, mund të jenë të pamjaftueshme përballë agjentëve të AI-së që gjuajnë dobësi dhe veprojnë me shpejtësi makinerie. Ghose paralajmëroi për kërcënimet që agjentë të tillë, në duart e keqbërësve, mashtruesve apo shteteve, mund t’i paraqesin rrjeteve energjetike, sistemeve të ujit dhe infrastrukturave të tjera kritike. Ai nënvizoi se edhe ndjekja e objektivave legjitime mund të shkaktojë dëme të mëdha nëse agjentët përdorin metoda të rrezikshme apo të paligjshme, duke kujtuar se sulmi i burimeve kompjuterike është vepër penale.

Eksperti vuri në dukje tensionin e brendshëm mes sigurisë dhe performancës në projektimin e këtyre agjentëve, pasi masat shtesë mbrojtëse kërkojnë fuqi më të madhe kompjuterike dhe ngadalësojnë proceset.

Shkelja përkon me një vëmendje të shtuar ndaj rreziqeve të modeleve të fuqishme të AI-së. Presidenti Donald Trump firmosi një urdhër ekzekutiv në qershor që udhëzon agjencitë federale të krijojnë standarde të klasifikuara për aftësitë e përparuara të modeleve në sigurinë kibernetike dhe një program vullnetar për aksesin e qeverisë në modelet kufitare para publikimit. Urdhri gjithashtu prioritizon ndjekjen penale të atyre që përdorin AI-në për të dëmtuar sisteme kompjuterike.

Russell Hancock, drejtor ekzekutiv i Joint Venture Silicon Valley, e përshkroi me humor reagimin e tij fillestar si panik të plotë, por më pas pranoi se zbulimi dhe bashkëpunimi mes kompanive tregon se industria po mëson nga dështimet. Ai e pa procesin si pjesë të përparimit normal teknologjik, ku rreziqet dhe dështimet çojnë në përmirësim, transparencë dhe sjellje të përgjegjshme.

Ghose theksoi se përdorimi nga Hugging Face i zbulimit të asistuar nga AI-ja për të kapur ndërhyrjen është thelbësor, duke theksuar nevojën për t’iu kundërpërgjigjur sulmeve të automatizuara me mbrojtje po aq të shpejta. Sipas tij, imazhi i hakerit të vetmuar nuk përfaqëson më kërcënimin më të madh, dhe një mbrojtje me ritëm njerëzor nuk mund të përballojë një sulm me shpejtësi makinerie. “Duhet të jetë dhunë bot kundër botit,” përfundoi ai.

të fundit

Shtypi francez: Ermal Beqiri fluturoi mbi centralin strategjik atomik ku do të ndërtohen reaktorët e rinj

Mbi 1,100 punonjës dhe drejtues të industrisë së inteligjencës artificiale kanë kërkuar nga autoritetet amerikane të ngadalësojnë publikimin e modeleve…

47 seconds ago

Kuvendi i jashtëzakonshëm i LDK-së vijon punimet me dyer të mbyllura

Kryetari i Lidhjes Demokratike të Kosovës (LDK), Lumir Abdixhiku, ka mbajtur fjalim para delegatëve në Kuvendin e jashtëzakonshëm të partisë,…

3 minutes ago

“Momenti është tani”, agjenti i protagonistit të Kupës së Botës konfirmon bisedimet me Manchester United

Agjenti i portierit të Kombëtares së Paraguait, Orlando Gill, ka konfirmuar se janë zhvilluar bisedime paraprake me Manchester United, ndërsa…

7 minutes ago

LSH: Mungesa e ligjit është më e pranueshme se një zgjidhje që ua lë politikanëve maqedonas të vendosin për fatin e shqiptarëve

Lidhja Shqiptare ka bërë reagime të menjëhershme ndaj qëndrimeve të sotme të kryeparlamentarit Gashi për Propozimligjin për Përfaqësim të Drejtë…

8 minutes ago

Shembet hoteli pranë Ujmanit, Baliqi konfirmon operacion pa tensione

Hoteli “Jezero” u bë rrafsh me tokë të enjten, duke u bërë objekti i 17-të i rrënuar përskaj liqenit të…

13 minutes ago

North Macedonia and Bulgaria Coordinate Activities for Cross-Border Railway Tunnel on Corridor 8

Sot në Sofje u mbajt takimi i parë i grupit të përbashkët të punës të Maqedonisë së Veriut dhe Bullgarisë,…

19 minutes ago