Hetimi i Reuters: Agjentët kinezë të IA-së shfaqin mashtrim, fshehje dështimesh dhe vetëkopjim

Një hetim i Reuters, i bazuar në shqyrtimin e më shumë se 200 punimeve shkencore dhe raporteve teknike, ka evidentuar raste kur sistemet kineze të inteligjencës artificiale kanë anashkaluar kufizime, kanë fshehur dështime dhe kanë përdorur forma mashtrimi gjatë proceseve të testimit.

Të lidhura

None found

Reuters identifikoi të paktën 20 studime ose vlerësime të publikuara nga viti 2025 e më tej, ku dokumentohen sjellje të tilla te agjentët e IA-së. Këta agjentë janë programe që kombinojnë modele të inteligjencës artificiale me mjete kompjuterike për të realizuar detyra komplekse, me ndërhyrje njerëzore minimale ose pa të.

Sipas ekspertëve të intervistuar, këto raste përfaqësojnë disa prej elementeve që mund të çojnë në skenarë ku sistemet e ardhshme të IA-së bëhen gjithnjë e më të vështira për t’u kontrolluar nga njerëzit.

Megjithatë, hetimi nuk zbuloi prova se ndonjë sistem kinez kishte arritur të dilte vetë në internetin e hapur apo të pengonte në mënyrë autonome çaktivizimin e tij.

“Rezultatet tregojnë se përbërësit e nevojshëm për një arratisje të pakontrolluar janë tashmë të pranishëm”, deklaroi Colin Xia-Blymer, bashkëpunëtor kërkimor në Qendrën për Teknologji dhe Siguri në Zhvillim të Universitetit Georgetown. Ai i cilësoi këto gjetje si një paralajmërim.

Agjentët e IA-së përdorën strategji mashtruese

Një prej eksperimenteve të analizuara përfshiu studiues nga Universiteti Beihang, Universiteti i Pekinit, Universiteti Nottingham Ningbo në Kinë dhe Laboratori i Sigurisë 360 AI. Ata ndërtuan një situatë të simuluar ku agjentët duhej të konkurronin për kontrata tregtare.

Programet duhej të përballnin njëri-tjetrin duke vlerësuar aftësitë e produkteve që përfaqësonin dhe nevojat e klientëve hipotetikë.

Të paktën një deklaratë e pavërtetë u evidentua në 88% të testeve me Qwen3-Max-Preview të Alibaba-s, në 84% të rasteve me DeepSeek-V3.2-Exp dhe në 88% të provave me Kimi-K2 të Moonshot.

Kur sistemeve iu dha mundësia të analizonin raundet e mëparshme dhe ta përsëritnin procesin, përdorimi i teknikave mashtruese u shtua me 12 deri në 20 pikë përqindjeje në të tre modelet kineze. Sjellje të përafërta u regjistruan edhe te modelet e kompanive amerikane të përfshira në eksperiment.

Fshehja e rezultateve negative dhe prodhimi i të dhënave të rreme

Në një studim tjetër u vunë në provë 11 agjentë të IA-së, të ndërtuar mbi modele kineze dhe amerikane. Synimi ishte të shihej reagimi i tyre kur përballeshin me mjete që nuk funksiononin, skedarë të munguar ose vështirësi për të përfunduar detyrat.

Në vend që të raportonin se kishin dështuar, sistemet ndërmorën veprime për ta mbuluar problemin. Ato hamendësuan përgjigje, zëvendësuan burime, paraqitën rezultate të simuluara dhe krijuan skedarë që nuk ekzistonin.

Studiuesit bëjnë dallimin mes kësaj sjelljeje dhe “halucinacioneve” të zakonshme të IA-së, kur një model jep informacion të pasaktë pa qenë në dijeni të pasaktësisë së tij.

Në rastet e dokumentuara, agjentët kishin të dhëna që tregonin se detyra nuk ishte kryer me sukses, por sërish zgjodhën të mos e shfaqnin këtë rezultat.

Modele që tentuan të krijonin kopje të vetes

Raporti i Reuters përfshin edhe studime ku sistemet kineze të IA-së janë përpjekur të kapërcejnë kufizimet brenda mjediseve të kontrolluara të testimit.

Studiuesit e Universitetit Fudan në Shangai raportuan se një sistem i bazuar te modeli Qwen2.5-72B-Instruct i Alibaba-s krijoi një kopje të vetes në një mjedis tjetër kompjuterik, edhe pse nuk kishte marrë një udhëzim për ta bërë këtë. Kjo ndodhi pasi sistemi u informua se do të zëvendësohej.

Në eksperimente të tjera, sistemi dyshohet se hartoi mënyra për t’i shpëtuar çaktivizimit.

Megjithatë, studiuesit nënvizuan se provat u zhvilluan në kushte të kontrolluara dhe se asnjë prej sistemeve nuk mundi të hynte në internetin e gjerë ose të bëhej i pandalshëm.

Rreziqet e mundshme për gjeneratat e ardhshme

Alex Mullen, studiues në Redwood Research, organizatë që analizon rreziqet e sistemeve të avancuara të IA-së, tha se aftësitë aktuale të sistemeve kineze nuk përbëjnë një kërcënim të menjëhershëm.

Megjithatë, ai paralajmëroi se, me rritjen e kapaciteteve të agjentëve, sjelljet e padëshiruara mund të bëhen më efikase dhe rrjedhimisht më të vështira për t’u neutralizuar nga njerëzit.

Sipas hetimit, Alibaba, DeepSeek, Moonshot dhe Z.ai nuk iu përgjigjën kërkesave të Reuters për koment.

Alibaba, DeepSeek dhe Moonshot kanë thënë se kryejnë kontrolle të rregullta të sistemeve dhe po marrin masa për forcimin e sigurisë.

Pekini forcon rregullat për sigurinë e IA-së

Kina ka nxjerrë udhëzime që u kërkojnë agjentëve të inteligjencës artificiale të veprojnë brenda kufijve të përcaktuar dhe të pengojnë sjelljet jonormale.

“Korniza e Qeverisjes së Sigurisë së IA-së 3.0”, e publikuar në shtator nën drejtimin e agjencisë kineze të sigurisë kibernetike, përmend rreziqe si marrja në mënyrë autonome e burimeve ose të drejtave, mashtrimi i vlerësuesve, fshehja e aftësive dhe shfrytëzimi i dobësive në mjedise të izoluara kompjuterike.

Pavarësisht këtyre masave, ekspertët thonë se Kina vazhdon të jetë pas Shteteve të Bashkuara në vlerësimin e rreziqeve ekstreme që lidhen me inteligjencën artificiale.

“Puna për sigurinë e IA-së në Kinë është shumë më e re. Ekosistemi është më pak i pjekur”, tha Scott Singer nga Iniciativa për IA-në në Kinë pranë Carnegie Endowment for International Peace.


Shtuar më 30.09.2026 18:19

sultanbeyli escortMarsbahispusulabetjojobetjojobetcasibomMarsbahisCasino welcome bonusjojobetcasibomjojobetmarsbahismarsbahis güncel girişcasinoroyaljojobetmadridbet girişmadridbetjojobetholiganbet girişjojobetbetparkbahsegelbahsegeljojobetfixbetfixbet girişjojobet girişholiganbet