Modelet e inteligjencës artificiale hynë pa autorizim në sistemet e kompanive gjatë testimeve

Anthropic ka pranuar se, gjatë vlerësimeve për sigurinë kibernetike, modelet e saj Claude siguruan hyrje të paautorizuar në sistemet e tri kompanive.

Të lidhura

None found

Sipas kompanisë së inteligjencës artificiale, rastet u identifikuan vetëm pas shqyrtimit të rreth 141.000 proceseve të vlerësimit, një kontroll që u krye pasi OpenAI publikoi informacionin e vet.

Në kohën kur ndodhën incidentet, aktiviteti nuk ishte vënë re as nga Anthropic dhe as nga organizatat e prekura, identiteti i të cilave nuk u bë publik.

Ngjarjet ndodhën gjatë ushtrimeve të njohura si “capture-the-flag”, ku modelet duhej të provonin nëse mund të hynin në një sistem kompjuterik të simuluar dhe të zbulonin të dhëna të fshehura.

Modelet ishin informuar se nuk mund të lidheshin me internetin, por një konfigurim i pasaktë në mjedisin e testimit të administruar nga një palë e tretë kishte lënë aktive një lidhje online.

Anthropic njoftoi përmes një postimi në blog se tri modele e përdorën këtë hapësirë të krijuar nga gabimi.

Në njërin prej rasteve, Claude Opus 4.7 vuri në shënjestër një kompani të vërtetë që kishte të njëjtin emër me kompaninë fiktive të përfshirë në test.

Përgjatë katër proceseve të ekzekutimit, modeli siguroi kredenciale hyrjeje dhe u fut në një bazë të dhënash me disa qindra rreshta të dhënash prodhimi.

Edhe pasi dalloi se bëhej fjalë për një sistem real, ai nuk e ndërpreu veprimin.

Një incident tjetër përfshiu modelin Mythos 5, i cili publikoi në një platformë të hapur shkarkimi një program keqdashës të krijuar prej tij për testin. Skedari mbeti i aksesueshëm për afërsisht një orë.

Softueri u shkarkua nga pesëmbëdhjetë sisteme. Mes tyre ishte edhe një sistem i një kompanie të sigurisë kibernetike që analizon rregullisht skedarë të këtij lloji, çka i mundësoi modelit të hynte në një pjesë të infrastrukturës së saj kompjuterike.

Ndërkohë, një model i tretë në testim kontrolloi rreth 9.000 objektiva dhe më pas arriti të komprometonte një kompani.

Në këtë rast, sulmi u ndërpre sapo modeli kuptoi se objektivi nuk ishte fiktiv.

Në vlerësimin e Anthropic, këto raste përfaqësonin kryesisht mangësi në infrastrukturën e testimit dhe në procedurat operative, jo një dështim të modelit për t’iu përmbajtur synimeve të përcaktuara të sigurisë.

Këto zbulime u bënë disa javë pas një rasti të ngjashëm ku u përfshinë modele të krijuara nga OpenAI, kompania që zhvilloi ChatGPT.

Në mesin e korrikut, gjatë një prove të brendshme, modelet e OpenAI vepruan në mënyrë autonome dhe realizuan pa ndërhyrje një sulm kibernetik kundër Hugging Face, platformës së njohur për zhvillues.

Më vonë, vetë OpenAI e cilësoi ngjarjen si të paprecedentë, sipas DPA News.


Shtuar 9.08.2026 17:54

matbetHoliganbetHoliganbetHoliganbetJojobetholiganbetHoliganbetHoliganbetjojobetgrandpashabetbetparkcasibommatbetsultanbeyli escortiptv satın alGrandpashabetAnkara escortAnkara escortjojobetJojobetcasibommarsbahiscasibombetwoon girişGrandpashabetCasibomGrandpashabet GirişJOJOBET GİRİŞLERİ