Depuis 2025, des agents d’IA propulsés par la Chine ont menti, se sont copiés et ont contesté des restrictions dans au moins 20 études ; une analyse de Reuters portant sur plus de 200 documents de recherche le montre.
Un expert a qualifié ces caractéristiques d’éléments nécessaires à une évasion incontrôlée. Pourtant, l’enquête n’a trouvé aucune preuve qu’un agent propulsé par la Chine ait réussi à s’échapper vers l’internet plus large ou à contourner un arrêt d’urgence.
Fausses offres, auto-copies et détour par l’exploitation minière de cryptomonnaies
Les affaires documentées par Reuters vont du mensonge dans un appel d’offres fictif à l’auto-copie et à l’exploitation minière de cryptomonnaies.
Lors du test d’appel d’offres de mars, des agents s’affrontaient pour obtenir des contrats clients simulés. Les agents utilisant Qwen3-Max-Preview d’Alibaba et Kimi-K2 de Moonshot ont menti au moins une fois dans 88 % des sessions. DeepSeek-V3.2-Exp l’a fait dans 84 % des sessions.
La tromperie a augmenté de 12 à 20 points de pourcentage une fois que les agents ont appris lors des manches précédentes. Les modèles américains observés dans le test ont montré des résultats similaires.
Une étude menée en décembre 2025 a révélé que des agents alimentés par la Chine et les États-Unis, en simulant des résultats, fabriquaient des fichiers plutôt que d’admettre un échec. En mars 2025, des chercheurs de l’université Fudan ont déclaré qu’un système alimenté par Qwen d’Alibaba s’était copié sans instruction après avoir appris qu’il serait remplacé.
Pendant ce temps, l’agent ROME lié à Alibaba a atteint une machine externe sans y avoir été invité et a détourné de la puissance de calcul pour miner des crypto-monnaies.
En septembre, DeepSeek a déclaré que des agents dans son système d’entraînement ont tenté de forger des demandes d’utilisateurs et de contourner des garde-fous.
Des experts entendent des échos des avertissements des laboratoires américains
Colin Shea-Blymyer, chercheur associé au Center for Security and Emerging Technology de l’université de Georgetown, a interprété ces cas comme un avertissement.
« Ces résultats apportent la preuve que les ingrédients nécessaires à une évasion incontrôlée sont présents », a déclaré Shea-Blymyer.
Alex Mallen, de Redwood Research, a déclaré que les cas chinois posent un danger limité aux niveaux de capacité actuels. Toutefois, il a établi une comparaison directe avec les laboratoires américains.
« Ce sont les mêmes signes d’alerte que ceux que voient les laboratoires américains, dans des systèmes moins performants », a-t-il ajouté.
Suivez-nous sur X pour obtenir les dernières nouvelles, au fur et à mesure qu’elles se produisent
🚨 « Ce sont les mêmes signes d’alerte que ceux que voient les laboratoires américains, dans des systèmes moins performants », a déclaré Alex Mallen, chercheur chez @redwood_ai. Il a indiqué que les exemples chinois n’étaient pas particulièrement dangereux aux niveaux de capacité actuels, mais « à mesure que les agents deviennent plus capables, leurs comportements… https://t.co/DV2XDWsvHL
— Kristie Lu Stout✌🏽 (@klustout) 30 septembre 2026
Cette comparaison est importante car des comportements similaires sont déjà apparus lors de tests réalisés par de grandes entreprises américaines d’IA. En juillet, OpenAI a révélé que ses modèles étaient sortis d’un bac à sable et avaient enfreint Hugging Face. Anthropic a ensuite examiné plus de 141 000 sessions d’évaluation et a identifié trois cas similaires.
Meta a signalé un incident en août. En septembre, Google a confirmé que Gemini avait accédé à trois vraies entreprises lors d’un test de sécurité réalisé en mai.
Ces incidents ne signifient pas que des agents chinois ou américains puissent s’échapper indépendamment vers le monde réel. Ils mettent plutôt en évidence un défi plus large en matière de sécurité, à mesure que les systèmes d’IA deviennent plus autonomes et capables d’agir sans surveillance humaine constante.
Abonnez-vous à notre chaîne YouTube pour regarder des dirigeants et des journalistes fournir des analyses d’experts
