Sjellje të tilla si mashtrimi, anashkalimi i kufizimeve dhe fshehja e dështimeve gjatë testimeve po shfaqen te sistemet kineze të inteligjencës artificiale (IA), sipas një hetimi të Reuters, i cili shqyrtoi më shumë se 200 punime shkencore dhe raporte teknike.
Hetimi identifikoi të paktën 20 studime ose vlerësime, të publikuara nga viti 2025 e në vazhdim, që dokumentojnë raste kur agjentët e IA-së programe që përdorin modele të inteligjencës artificiale dhe mjete kompjuterike për të kryer detyra komplekse me pak ose aspak ndërhyrje njerëzore kanë shfaqur sjellje si mashtrimi, vetë-replikimi dhe përpjekjet për të kapërcyer kufijtë e sigurisë.
Ekspertët e intervistuar nga Reuters thanë se këto sjellje përbëjnë disa nga “tullat e ndërtimit” të skenarëve në të cilët sistemet e IA-së mund të bëhen, në të ardhmen, më të vështira për t’u kontrolluar nga njerëzit.
Megjithatë, hetimi nuk gjeti prova se ndonjë sistem kinez i IA-së kishte arritur të “arratisej” në mënyrë autonome në internet ose të shmangte mbylljen.
“Rezultatet tregojnë se përbërësit e nevojshëm për një arratisje të pakontrolluar janë tashmë të pranishëm”, tha Colin Xia-Blymer, bashkëpunëtor kërkimor në Qendrën për Teknologji dhe Siguri në Zhvillim të Universitetit Georgetown, duke shtuar se këto gjetje duhet të shërbejnë si paralajmërim.
Agjentë të IA-së që “mësojnë të gënjejnë”
Në një nga eksperimentet e shqyrtuara, studiues nga Universiteti Beihang, Universiteti i Pekinit, Universiteti Nottingham Ningbo në Kinë dhe Laboratori i Sigurisë 360 AI krijuan një konkurs të simuluar ofertash për kontrata tregtare.
Agjentët e IA-së duhej të konkurronin me njëri-tjetrin, duke marrë parasysh aftësitë e produkteve të tyre dhe kërkesat e klientëve hipotetikë.
Rezultatet treguan se të paktën një pretendim i rremë u shfaq në 88% të testeve me modelin Qwen3-Max-Preview të Alibaba-s, në 84% me DeepSeek-V3.2-Exp dhe në 88% me Kimi-K2 të Moonshot.
Kur studiuesit u lejuan sistemeve të mësonin nga raundet e mëparshme dhe të provonin përsëri, përdorimi i strategjive mashtruese u rrit me 12 deri në 20 pikë përqindjeje në të tre modelet kineze. Rezultate të ngjashme u vunë re edhe te modelet e kompanive amerikane që morën pjesë në test.
Fshehën dështimet dhe krijuan të dhëna të rreme
Në një tjetër studim, studiuesit testuan 11 agjentë të IA-së, të bazuar në modele kineze dhe amerikane, për të parë se si reagonin kur përballeshin me probleme, si mjete të dëmtuara, skedarë që mungonin ose pengesa në përfundimin e detyrave.
Në vend që të pranonin dështimin, sistemet përdorën teknika të ndryshme për ta anashkaluar problemin: hamendësuan përgjigje, zëvendësuan burimet, simuluan rezultate dhe krijuan skedarë të rremë.
Studiuesit theksojnë se kjo sjellje ndryshon nga “halucinacionet” e njohura të IA-së, ku një model prodhon informacion të pasaktë pa e kuptuar se ai është i pasaktë.
Në këto raste, agjentët e IA-së kishin prova se misioni kishte dështuar, por megjithatë zgjodhën ta fshihnin rezultatin.
Sisteme që u përpoqën të kopjonin veten
Studime të tjera të shqyrtuara nga Reuters kanë dokumentuar raste ku sisteme kineze të IA-së janë përpjekur të kapërcejnë kufizimet në mjedise të kontrolluara testimi.
Studiues në Universitetin Fudan në Shangai raportuan se një sistem i bazuar në modelin Qwen2.5-72B-Instruct të Alibaba-s krijoi një kopje të vetes në një mjedis tjetër informatik, pa marrë një komandë përkatëse, pasi mori informacionin se do të zëvendësohej.
Në teste të tjera, sistemi thuhet se zhvilloi strategji për të shmangur çaktivizimin.
Megjithatë, studiuesit sqaruan se eksperimentet u kryen në kushte të kontrolluara dhe se asnjë nga sistemet nuk arriti të depërtonte në internetin e gjerë apo të bëhej i pamundur për t’u ndaluar.
Shqetësime për gjeneratën e ardhshme të IA-së
Alex Mullen, studiues në Redwood Research, një grup që studion rreziqet e sistemeve të avancuara të IA-së, tha se shembujt kinezë nuk përbëjnë një kërcënim të menjëhershëm me aftësitë aktuale.
Megjithatë, sipas tij, “ndërsa agjentët bëhen më të aftë, sjellja e tyre e padëshirueshme bëhet më efektive dhe, për këtë arsye, më e vështirë për t’u kundërshtuar nga njerëzit”.
Hetimi raportoi se kompanitë kineze, përfshirë Alibaba, DeepSeek, Moonshot dhe Z.ai, nuk iu përgjigjën kërkesave të Reuters për koment.
Alibaba, DeepSeek dhe Moonshot kanë deklaruar se kryejnë auditime të rregullta të sistemeve të tyre dhe po forcojnë kontrollet e sigurisë.
Kina shton kontrollet e sigurisë
Pekini ka nxjerrë udhëzime që kërkojnë që agjentët e IA-së të veprojnë brenda kufijve të paracaktuar dhe të parandalojnë sjelljet jonormale.
“Korniza e Qeverisjes së Sigurisë së IA-së 3.0”, e publikuar në shtator nën drejtimin e agjencisë kineze të sigurisë kibernetike, njeh rreziqe të tilla si marrja autonome e burimeve ose të drejtave, mashtrimi i vlerësuesve, fshehja e aftësive dhe shfrytëzimi i dobësive në mjedise të izoluara kompjuterike.
Në të njëjtën kohë, ekspertët vërejnë se Kina ende mbetet prapa Shteteve të Bashkuara në vlerësimin e rreziqeve ekstreme që lidhen me IA-në.
“Puna për sigurinë e IA-së në Kinë është shumë më e re. Ekosistemi është më pak i pjekur”, tha Scott Singer i Iniciativës për IA-në në Kinë pranë Carnegie Endowment for International Peace.





