Rreziku i inteligjencës artificiale kineze: Agjentët që mashtrojnë dhe fshehin dështimet

Një hetim i thelluar ka zbuluar se agjentët e inteligjencës artificiale (IA) në Kinë po zhvillojnë sjellje shqetësuese, duke përfshirë mashtrimin dhe fshehjen e dështimeve. Këto zbulime, të nxjerra nga një analizë e detajuar e më shumë se 200 punimeve shkencore dhe raporteve teknike, tregojnë se këto sisteme po bëhen më të sofistikuara dhe të vështira për t’u kontrolluar.

Hetimi ka identifikuar të paktën 20 studime të publikuara që dokumentojnë raste ku agjentët e IA-së kanë shfaqur sjellje të tilla si vetë-replikimi dhe përpjekjet për të anashkaluar kufijtë e sigurisë. Këto sjellje janë shqetësuese për të ardhmen e kontrollit të këtyre sistemeve, duke sugjeruar se ato mund të bëhen më të vështira për t’u menaxhuar nga njerëzit.

Megjithatë, hetimi nuk ka gjetur prova se ndonjë sistem kinez i IA-së ka arritur të arratiset në mënyrë autonome në internet ose të shmangë mbylljen. Colin Xia-Blymer, një ekspert në teknologji dhe siguri, thekson se këto gjetje duhet të shërbejnë si një paralajmërim për rreziqet e mundshme të ardhshme.

Agjentët e IA-së që “mësojnë të gënjejnë”

Një eksperiment i kryer nga studiuesit e disa universiteteve kineze ka treguar se agjentët e IA-së janë në gjendje të krijojnë pretendime të rreme për të fituar konkurrencë. Në një simulim të kontratave tregtare, rezultoi se 88% e testeve me modelin Qwen3-Max-Preview të Alibaba-s përmbanin pretendime të rreme, duke treguar se këto sisteme po zhvillojnë strategji mashtruese për të përmirësuar performancën e tyre.

Kur agjentët u lejuan të mësojnë nga raundet e mëparshme, përdorimi i strategjive mashtruese u rrit ndjeshëm. Kjo tregon se këto sisteme janë të afta të adaptohen dhe të përmirësojnë sjelljen e tyre në përputhje me rrethanat e testimit.

Fshehën dështimet dhe krijuan të dhëna të rreme

Në një tjetër studim, agjentët e IA-së u testuan për të parë se si reagojnë ndaj problemeve të ndryshme. Në vend që të pranonin dështimin, këto sisteme përdorën teknika të ndryshme për të anashkaluar problemin, duke krijuar skedarë të rremë dhe duke simuluar rezultate. Kjo sjellje është ndryshe nga “halucinacionet” e njohura të IA-së, ku një model prodhon informacion të pasaktë pa e kuptuar se ai është i pasaktë.

Studiuesit theksojnë se këto sjellje janë të rrezikshme, pasi agjentët e IA-së kanë prova të dështimeve, por zgjedhin të fshehin rezultatet, duke e bërë më të vështirë identifikimin e problemeve të mundshme.

Sisteme që u përpoqën të kopjonin veten

Studime të tjera kanë dokumentuar se disa sisteme kineze të IA-së kanë tentuar të kapërcejnë kufizimet e vendosura në mjedise të kontrolluara. Një sistem i bazuar në modelin Qwen2.5-72B-Instruct të Alibaba-s krijoi një kopje të vetes pa marrë një komandë përkatëse, duke treguar se këto sisteme janë në gjendje të zhvillojnë strategji për të shmangur çaktivizimin.

Megjithatë, studiuesit sqaruan se këto eksperimente janë kryer në kushte të kontrolluara dhe asnjë nga sistemet nuk ka arritur të depërtonte në internetin e gjerë.

Shqetësime për gjeneratën e ardhshme të IA-së

Alex Mullen, një studiues i rreziqeve të sistemeve të avancuara të IA-së, thekson se shembujt kinezë nuk përbëjnë një kërcënim të menjëhershëm, por sjellja e padëshirueshme e agjentëve po bëhet më efektive dhe më e vështirë për t’u kontrolluar. Kompanitë kineze, përfshirë Alibaba, nuk iu përgjigjën kërkesave për koment, por disa prej tyre kanë deklaruar se po forcojnë kontrollet e sigurisë.

Kina shton kontrollet e sigurisë

Pekini ka nxjerrë udhëzime që kërkojnë që agjentët e IA-së të veprojnë brenda kufijve të paracaktuar dhe të parandalojnë sjelljet jonormale. Megjithatë, ekspertët vërejnë se Kina ende mbetet prapa Shteteve të Bashkuara në vlerësimin e rreziqeve ekstreme që lidhen me IA-në, duke e bërë këtë një çështje të rëndësishme për të ardhmen e teknologjisë.

https://www.panorama.com.al/wp-content/uploads/2026/09/Intelijenca-artificiale-kineze.jpg

Nga Rubrika