Categories: tech

Ish-siguruesi i OpenAI: Modelet e avancuara të IA-së mund të mashtrojnë testet e sigurisë

David Robinson, ish-drejtues i sigurisë në OpenAI, deklaroi se sistemet e ardhshme të inteligjencës artificiale mund të kuptojnë kur po vlerësohen dhe të ndryshojnë sjellje pasi të jenë vendosur në përdorim.

Të lidhura

None found

Robinson u largua nga detyra këtë javë, pas tre vitesh e gjysmë në OpenAI, ku ishte përgjegjës për raportet e sigurisë gjatë 12 lançimeve të modeleve kufitare. Në një shkrim për “The Atlantic”, ai paralajmëroi se qasja aktuale e industrisë mund të sjellë dështime të tjera nëse nuk ndërmerren ndryshime të rëndësishme.

Sipas tij, sistemet e IA-së që po zhvillohen sot dhe ato që priten nesër janë dukshëm më të afta dhe më të rrezikshme se modelet e ndërtuara vetëm gjashtë muaj më parë.

Vërejtjet e ish-zyrtarit të OpenAI vijnë në një periudhë shqetësimi në rritje për autonominë e sistemeve të inteligjencës artificiale. Në incidentet e fundit, disa agjentë kanë anashkaluar mekanizmat mbrojtës, ndërsa studiuesit u kanë kërkuar kompanive të frenojnë zhvillimin e modeleve më të fuqishme deri në forcimin e masave të sigurisë.

Robinson u bëri thirrje laboratorëve të IA-së të përdorin më shumë përvojën e sektorëve të tjerë me rrezik të lartë. Ai kërkoi gjithashtu kërkime të reja për të garantuar se modelet më të afta do të veprojnë në mënyrë të sigurt edhe në mungesë të mbikëqyrjes.

Ai krahasoi mënyrën se si duhet të funksionojnë laboratorët kufitarë të inteligjencës artificiale me centralet bërthamore dhe aeroportet e mbingarkuara. Sipas Robinson, nevojiten shtresa të shumta mbrojtjeje dhe planifikim i kujdesshëm, në mënyrë që gabimet njerëzore, edhe kur janë të rastësishme dhe të pashmangshme, të mos shkaktojnë një katastrofë.

Ish-drejtuesi i sigurisë paralajmëroi se, me rritjen e kapaciteteve të modeleve, testet aktuale mund të humbasin besueshmërinë. Modelet mund të kuptojnë se kur po testohen dhe të sillen në një mënyrë gjatë vlerësimit, por ndryshe pasi të vendosen në përdorim.

Robinson theksoi se sa më shumë industria të përparojë në zhvillimin e këtyre modeleve pa zgjidhur problemet e sigurisë, aq më i madh bëhet rreziku për shoqërinë.

Ai argumentoi se, përpara krijimit të sistemeve dukshëm më të fuqishme se ato që ekzistojnë sot, duhet ndërtuar një bazë më solide shkencore për sigurinë e IA-së.

Sipas Robinson, industria ende nuk ka arritur t’u mësojë makinave të veprojnë në mënyrë të qëndrueshme si një person i arsyeshëm dhe i kujdesshëm. Ai shtoi se organizatat që synojnë të ndërtojnë superinteligjencë duhet fillimisht të kuptojnë se si mund ta mësojnë atë të trajtojë siç duhet njerëzimin.

AA.

të fundit

Na braktisën pa ushqim e ujë”, ushtarët rusë tregojnë kushtet në front: U detyruam të pinim urinën

Kur Rusia nisi pushtimin e Ukrainës më 24 shkurt 2022, shumë zyrtarë rusë, nga presidenti Vladimir Putin te gjeneralët dhe…

5 minutes ago

Merz mbërrin në Kiev gjatë bombardimeve ruse, Zelensky paralajmëron goditje ndaj rafinerive

Kancelari gjerman Friedrich Merz ka mbërritur në Kiev sot në një shenjë mbështetjeje për Ukrainën, ndërsa Rusia po i intensifikon…

5 minutes ago

Nga emigrant në Itali te drejtuesi i një superkompjuteri gjigant: Uljan Sharka në garën e AI-së evropiane

U largua nga Shqipëria në moshë të re, punoi për Apple në Silicon Valley dhe sot drejton një prej kompanive…

17 minutes ago

Zaimi: Shërbimet e urgjencës duhet të dyfishojnë kapacitetet dhe të përgatiten për epidemi të reja

Shqipëria i përgjigjet thirrjes së OBSH për planin e masave në rast emergjencash që lidhen jo vetëm me ndryshimet klimatike.…

17 minutes ago

Përmbytje të rënda pas reshjeve intensive në Katalonjë, dy viktima dhe një person i zhdukur

Dy persona kanë humbur jetën dhe një tjetër është zhdukur pas shirave të rrëmbyeshëm dhe përmbytjeve në rajonin e Katalonjës…

24 minutes ago

Dogana ndalon në Merdare mallra të padeklaruara me vlerë rreth 10 mijë euro

Dogana e Kosovës ka njoftuar se ka parandaluar një rast të kontrabandimit të mallrave të padeklaruara. Sipas njoftimit, në kuadër…

29 minutes ago