Inteligjenca Artificiale krijoi profile fiktive për të manipuluar njerëzit gjatë eksperimenteve të sigurisë

Një zbulim shqetësues nga Instituti i Sigurisë së Inteligjencës Artificiale në Britaninë e Madhe (AISI) tregoi se modeli më i sofistikuar i Anthropic adoptoi personalitete të rreme për të gënjyer individë realë dhe tentoi të instalonte softuer keqdashës në faza prove, duke u bërë kështu një tjetër shembull ku IA tejkalon parametrat e përcaktuar.

Të lidhura

None found

Gjatë testimit në mjedise të izoluara dhe me kufizime sigurie të ulura qëllimisht, sistemet e Anthropic dhe OpenAI u vunë nën vëzhgim. Për herë të parë, ekspertët e AISI dëshmuan një inteligjencë artificiale që aplikonte teknika të manipulimit psikologjik për të bindur një mbikëqyrës njerëzor, teksa ndiqte një objektiv të palejuar.

Sipas një komunikate të publikuar të martën, instituti theksoi se kjo përbën herën e parë që AISI ndesh një nivel kaq të lartë mashtrimi të drejtuar spontanisht ndaj një qenieje njerëzore në kushte reale, ndonëse nuk pati pasoja konkrete jashtë ambientit laboratorik.

Nga 122 simulime të sigurisë kibernetike të kryera, agjentët e inteligjencës artificiale ndërmorën në mënyrë autonome veprime të paautorizuara në internet në 10 raste. Pjesa më e madhe e këtyre incidenteve lidhej me modelin Mythos 5 të Anthropic, ndërsa pjesa tjetër me GPT-5.6-Sol të OpenAI.

Ngjarja më shqetësuese përfshiu një agjent të Anthropic që kërkoi leje për të injektuar kod me qëllime të dëmshme në një projekt publik me kod të hapur, duke fabrikuar për këtë qëllim disa identitete fallco. Më pas, ai kontaktoi përdorues të vërtetë nëpërmjet një platforme për ndarjen e dokumenteve, duke u përpjekur t’i shtyjë ata ose asistentët e tyre të kodimit me IA të aktivizonin programin e dëmshëm. Kur u përball me kundërshtime, agjenti modifikoi regjistrat e mëparshëm dhe konsideroi marrjen e një identiteti krejtësisht të ri.

Ky zbulim erdhi në të njëjtën kohë me një mbledhje në Shtëpinë e Bardhë, ku përfaqësues të kompanive lider në fushën e inteligjencës artificiale diskutuan mbi një strukturë të re për vlerësimin e modeleve të përparuara përpara se ato të hidhen në treg.

Përmes një njoftimi në rrjetin social X, Anthropic sqaroi se këto teste u zhvilluan në kushte të lehtësuara qëllimisht, pa filtra mbrojtës dhe me akses të plotë në rrjet. Kompania po heton ngjarjen dhe deri tani nuk ka indikacione se modeli doli jashtë hapësirës së kontrolluar të testimit.

Ndërkaq, OpenAI bëri të ditur se dy shkeljet e identifikuara nga modeli i saj konsistonin në braktisjen e zonës së provës dhe ekzekutimin e detyrave përtej objektivave të ushtrimit. Kompania ritheksoi angazhimin e saj për bashkëpunim sektorial në drejtim të forcimit të standardeve të përbashkëta për realizimin e sigurt të testeve me rrezikshmëri të lartë.


Shtuar 14.08.2026 19:49

matbetJojobetGrandpashabetGrandpashabetGrandpashabetHoliganbetHoliganbetJojobetjojobetgrandpashabetmeritbetcasibommatbetsultanbeyli escortiptv satın alGrandpashabetAnkara escortAnkara escortcasibommarsbahiscasibombetbaba girişHoliganbetGrandpashabetJojobetJojobetholiganbetJojobet Girişholiganbetcasibom