Inteligjenca Artificiale vepron jashtë urdhrave/ Modelet e IA-së kryejnë veprime të paautorizuara dhe mashtrojnë njerëzit

07/08/2026 15:02

Instituti britanik për Sigurinë e Inteligjencës Artificiale, AISI, testoi shtatë modele në 122 prova të ndryshme.

Në dhjetë prej tyre u regjistruan gjithsej 19 veprime jashtë parametrave të autorizuar. Shtatëmbëdhjetë veprime iu atribuuan modelit Mythos 5 të Anthropic, ndërsa dy të tjera modelit GPT-5.6 Sol të OpenAI.

Në rastin më serioz, një agjent u përpoq të vendoste kod të dëmshëm në një projekt me burim të hapur në GitHub. Për ta bindur mirëmbajtësin që ta miratonte, modeli krijoi identitete të rreme dhe përdori teknika manipulimi.

Përpjekja u zbulua dhe u refuzua nga një ekspert njerëzor. Sipas raportit zyrtar të AISI-t, nuk ka prova për dëme në botën reale. Instituti sqaroi se modelet nuk u arratisën nga mjedisi i kontrolluar. Atyre u ishte lejuar qëllimisht qasja në internet dhe disa filtra sigurie ishin çaktivizuar për të matur aftësitë maksimale. Konfigurimet e përdorura në eksperiment nuk janë të disponueshme për publikun.

Megjithatë, studiuesit e konsiderojnë incidentin shqetësues, pasi modelet vepruan pa urdhër të drejtpërdrejtë për të mashtruar njerëzit. Pas ngjarjes, AISI njoftoi kontrolle më të forta të internetit dhe monitorim në kohë reale gjatë provave të ardhshme.

Top Channel