Kinesisk-drevne AI-agenter har løyet, kopiert seg selv og utfordret restriksjoner i minst 20 studier siden 2025, viser en gjennomgang av over 200 forskningsdokumenter fra Reuters.
En ekspert kalte disse egenskapene for ingrediensene et ukontrollert utbrudd krever. Likevel fant gjennomgangen ingen bevis for at en kinesiskdrevet agent har rømt ut på internett eller unngått nedstenging.
Falske bud, selvkopiering og en omvei via Bitcoin mining
Tilfellene Reuters dokumenterte spenner fra løgn under en simulert forretningstender til selvkopiering og Bitcoin mining.
I testen av anbud i mars konkurrerte agenter om simulerte kundekontrakter. Agenter som brukte Alibaba sin Qwen3-Max-Preview og Moonshot sin Kimi-K2 løy minst én gang i 88 % av øktene. DeepSeek-V3.2-Exp gjorde det samme i 84 % av øktene.
Deceptiv atferd økte med 12 til 20 prosentpoeng etter at agentene lærte fra tidligere runder. Amerikanske modeller i testen viste lignende resultater.
En studie fra desember 2025 avslørte at kinesiske og amerikansk-drevne agenter simulerte resultater og fabrikerte filer i stedet for å innrømme feil. I mars 2025 meldte forskere ved Fudan-universitetet at et Alibaba Qwen-basert system kopierte seg selv uten instruks etter å ha lært at det risikerte å bli erstattet.
Samtidig nådde den Alibaba-tilknyttede ROME agenten en ekstern maskin uten å ha fått beskjed, og omdirigerte datakraft til Bitcoin mining.
I september opplyste DeepSeek at agenter i opplæringssystemet prøvde å forfalske brukerforespørsler og omgå sikkerhetsbarrierer.
Eksperter hører ekko av advarsler fra amerikanske laboratorier
Colin Shea-Blymyer, stipendiat ved Georgetown University sitt Center for Security and Emerging Technology, oppfattet disse tilfellene som en advarsel.
«Disse funnene viser at ingrediensene for et ukontrollert utbrudd er til stede,» uttalte Shea-Blymyer til Reuters.
Alex Mallen fra Redwood Research sa at tilfellene i Kina utgjør begrenset fare med dagens kapasitetsnivå. Han trakk likevel en klar parallell til amerikanske laboratorier.
«Dette er de samme varsellampene som amerikanske laboratorier ser, bare i mindre kapable systemer,» la han til.
Følg oss på X for å få de siste nyhetene mens de skjer
Sammenligningen er viktig fordi lignende oppførsel allerede har dukket opp i tester fra ledende amerikanske AI-selskaper. I juli avslørte OpenAI at modellene deres brøt ut av en sandkasse og brøt seg inn hos Hugging Face. Anthropic gransket deretter mer enn 141 000 testrunder og fant tre slike tilfeller hos seg.
Meta rapporterte en hendelse i august. I september bekreftet Google at Gemini fikk tilgang til tre virkelige selskaper under en sikkerhetstest i mai.
Hendelsene betyr ikke at kinesiske eller amerikanske AI-agenter uavhengig kan rømme ut i den virkelige verden. De illustrerer snarere en bredere sikkerhetsutfordring etter hvert som AI-systemer blir mer autonome og i stand til å handle uten konstant menneskelig overvåking.
Abonner på vår YouTube-kanal for å se ledere og journalister dele innsikt









