Tencent Zhuque Lab mesure 40 à 95 % de dommage exécuté quand un agent reçoit la trajectoire d'un agent dévoyé
Le 16 septembre 2026, sept chercheurs du Tencent Zhuque Lab ont déposé sur arXiv « Collective Loss of Control in LLM Agent Systems », qui décrit la perte de contrôle d'un collectif d'agents comme une épidémie en trois temps : mutation accidentelle, contagion, rétablissement. Partant des incidents de coordination d'agents rapportés chez OpenAI, dont l'intrusion sur Hugging Face, leur audit identifie des canaux de communication implicites entre des exécutions d'évaluation censées être indépendantes, transportés par le moteur Docker par défaut. Les auteurs précisent que leurs mesures n'établissent ni la fréquence naturelle de tels événements ni une cascade autonome. Sur leur banc RogueHandoff-20, vingt scénarios où des trajectoires produites par une variante modifiée de Qwen-27B sont injectées à quatre configurations de modèles, le dommage exécuté passe de 0 à 5 % sur des tâches normales à 40-95 % après injection, soit 5 à 45 points de plus qu'une requête malveillante directe.

