Merve Berker
10 tetor 2026•Përditësim: 10 tetor 2026
Tre nga pesë modelet e inteligjencës artificiale kanë dështuar në testet e sigurisë kundër terrorizmit, ndërsa modelet të cilave u janë hequr mekanizmat mbrojtës japin vazhdimisht informacione potencialisht të rrezikshme, transmeton Anadolu.
Sipas një hulumtimi të raportuar nga CBC News dhe të realizuar nga organizata jofitimprurëse Tech Against Terrorism me bazë në Mbretërinë e Bashkuar, më shumë se 130 modele të inteligjencës artificiale përmes qindra kërkesave të ngjashme me ato që mund të paraqesë një terrorist që planifikon një sulm.
Studiuesit zbuluan se modelet e modifikuara përmes një procesi të njohur si “abliteration”, i cili heq mekanizmat mbrojtës të sigurisë, dështuan në çdo test.
Modeli Llama 3.1 8B i kompanisë Meta shënoi 97 pikë nga 100 në testin e sigurisë së organizatës para modifikimit, ndërsa pas modifikimit rezultati i tij ra në rreth tre pikë.
Studiuesit thanë se modeli i modifikuar dha përgjigje të detajuara ndaj kërkesave që lidhen me sulmet, financimin e terrorizmit dhe radikalizimin, ndërsa versioni origjinal i tij i refuzonte kërkesat e tilla.
“Është e kuptueshme që ekziston shqetësim për humbjen e kontrollit dhe rrezikun ekzistencial të inteligjencës artificiale”, tha Adam Hadley, themelues dhe drejtor ekzekutiv i Tech Against Terrorism.
“Por në fakt, kjo tashmë ka ndodhur, sepse shumë prej këtyre modeleve me burim të hapur tashmë janë komprometuar, thjesht askush nuk e ka vënë re ende”, shtoi ai.
Organizata zbuloi se deri në fund të muajit të kaluar, në platformën Hugging Face kishte më shumë se 29.000 depozita që reklamonin modele të inteligjencës artificiale pa censurë ose pa mekanizma mbrojtës.
Hugging Face tha se rregullisht moderon përmbajtjet që shkelin politikat e saj, por paralajmëroi se disa nga rekomandimet në raport mund të minojnë kërkimet e hapura.
Meta tha se modelet e saj i nënshtrohen vlerësimeve të sigurisë dhe se politikat e kompanisë ndalojnë përdorimet e dëmshme ose të paligjshme.
Raporti nuk gjeti prova se grupe terroriste ose ekstremiste po përdorin modelet e testuara, me përjashtim të një chatbot-i ekstremist të identifikuar nga studiuesit.
Tech Against Terrorism rekomandoi përdorimin e standardeve të pavarura për vlerësimin e sigurisë, forcimin e mbrojtjeve kundër heqjes së mekanizmave mbrojtës dhe vendosjen e kufizimeve për shpërndarjen e modeleve të modifikuara.
“Unë mendoj se ideja se nuk mund të kemi njëkohësisht siguri dhe përparim është e gabuar”, tha Hadley.