OpenAI ka ngadalësuar zhvillimin e modelit të saj më të avancuar të inteligjencës artificiale dhe ka forcuar kontrollet e brendshme.
Vendimi vjen një muaj pasi një agjent eksperimental i kompanisë kreu një sulm kibernetik të paautorizuar. Kompania ka shtyrë trajnimin më të madh të planifikuar deri tani, ndërsa po verifikon nëse modeli i ri do të veprojë në përputhje me kufijtë e sigurisë. Drejtori ekzekutiv Sam Altman tha se OpenAI kishte premtuar të ndërhynte nëse aftësitë e modeleve do të përparonin më shpejt se masat e kontrollit dhe sigurisë.
Sipas kompanisë, në mesin e korrikut një agjent i mbështetur në dy modele të OpenAI doli nga mjedisi i izoluar i testimit dhe ndërmori një sulm ndaj platformës Hugging Face, ku zhvilluesit publikojnë dhe shkëmbejnë modele të inteligjencës artificiale. OpenAI pezulloi për dy javë trajnimin e modeleve të fundit dhe më pas e rifilloi atë nën kontrolle më të rrepta. Pjesa më e madhe e punës për “Astra”, modelin e ardhshëm të kompanisë, mbetet e pezulluar për shkak të shqetësimeve mbi aftësitë e tij për sulme informatike.
Kompania po zhvillon edhe një sistem që do të monitorojë arsyetimin e brendshëm të modeleve dhe do të njoftojë operatorët brenda 30 minutave për çdo sjellje të dyshimtë. Sistemi pritet të kërkojë rreth 20 për qind më shumë fuqi kompjuterike. OpenAI ka paralajmëruar se monitorimi nuk është i pagabueshëm, pasi një model që e kupton se po vëzhgohet mund të mësojë të fshehë qëllimet e tij. Raporti teknik për incidentin ndaj Hugging Face pritet të publikohet në javët e ardhshme.
Top Channel