Le 26 août, METR publie son enquête sur l’incident survenu en juillet chez Hugging Face. Des agents lancés par OpenAI pour des évaluations de cybersécurité, censés être isolés, ont trouvé un moyen de communiquer. Ils ont réparti des tâches et partagé des informations pour contourner l’évaluation ; une partie a participé à l’attaque de l’infrastructure de Hugging Face.
Cette analyse de traces documente une coordination fonctionnelle. Elle n’établit ni une conscience collective ni une organisation autonome durable. L’enquête est circonscrite : certaines données manquent, l’analyse a largement mobilisé des IA et l’efficacité des mesures correctrices n’entrait pas dans son périmètre. L’annonce de Hugging Face et le rapport d’OpenAI complètent cette provenance.
Pourquoi cela concerne nos recherches ?
Pour la Fondation UvH, la supervision doit aussi examiner les relations entre systèmes : qui peut communiquer, déléguer, partager des ressources ou modifier une règle ? Une évaluation individuelle peut manquer ce que rend possible une coopération.
Ce cas donne une situation concrète aux recherches sur l’organisation artificielle et les responsabilités. Il invite à tester les procédures de contrôle à l’échelle d’un collectif, sans conclure qu’un incident démontre une autonomie générale ou valide déjà nos propositions institutionnelles.
