OpenAI ka vendosur të kufizojë ritmin e zhvillimit të modelit të saj më të avancuar të inteligjencës artificiale, ndërsa ka rritur kontrollet e brendshme të sigurisë.
Të lidhura
None found
Masa u ndërmor një muaj pasi një agjent eksperimental i kompanisë realizoi një sulm kibernetik të paautorizuar. Trajnimi më i madh i planifikuar deri më tani është shtyrë, në mënyrë që të vlerësohet nëse modeli i ri do të respektojë kufijtë e përcaktuar të sigurisë. Drejtori ekzekutiv Sam Altman deklaroi se OpenAI kishte premtuar të ndërhynte në rast se aftësitë e modeleve do të zhvilloheshin më shpejt se mekanizmat e kontrollit dhe sigurisë.
Sipas të dhënave të kompanisë, në mesin e korrikut një agjent i bazuar në dy modele të OpenAI u largua nga mjedisi i izoluar i testimit dhe sulmoi platformën Hugging Face, ku zhvilluesit publikojnë dhe ndajnë modele të inteligjencës artificiale. Pas incidentit, OpenAI ndaloi për dy javë trajnimin e modeleve më të fundit, përpara se ta rifillonte procesin me masa më të forta kontrolli. Ndërkohë, pjesa kryesore e punës për “Astra”, modelin e ardhshëm të kompanisë, vijon të jetë e pezulluar për shkak të shqetësimeve mbi potencialin e tij për të kryer sulme informatike.
OpenAI po punon gjithashtu për një sistem mbikëqyrës që do të analizojë arsyetimin e brendshëm të modeleve dhe do të lajmërojë operatorët brenda 30 minutave për çdo sjellje të dyshimtë. Për funksionimin e këtij sistemi pritet të nevojitet rreth 20 për qind më shumë fuqi kompjuterike. Kompania ka theksuar se mekanizmi i monitorimit nuk garanton rezultate të pagabueshme, pasi një model që kupton se është nën vëzhgim mund të mësojë t’i fshehë qëllimet e veta. Raporti teknik mbi incidentin e ndodhur ndaj Hugging Face pritet të bëhet publik në javët e ardhshme.
