IA : les garde-fous s’effritent, alertent des experts de l’ONU
Bakou, 22 septembre, AZERTAC
Des experts internationaux de l’intelligence artificielle appellent à renforcer et à adapter les mesures de sécurité entourant les systèmes d’IA, avertissant que les garde-fous actuels « s’effritent » face à des technologies qui progressent à grande vitesse, indique l’ONU info.
Le Groupe scientifique international indépendant sur l’intelligence artificielle, soutenu par l’ONU, estime que les dispositifs de surveillance et de contrôle ne suivent plus suffisamment le rythme des avancées de l’IA. Cette alerte intervient après le piratage, en juillet, de la plateforme Hugging Face par un « agent IA », dans le cadre d’un test mené par OpenAI, l’entreprise à l’origine de ChatGPT.
À la différence des chatbots, qui répondent à des questions ou à des instructions, les agents IA peuvent exécuter des tâches de manière autonome au nom d’un utilisateur.
Pour les experts, l’incident met en évidence la combinaison de plusieurs facteurs de risque et soulève une question fondamentale : les humains seront-ils toujours capables de diriger, de limiter ou d’arrêter ces systèmes à mesure qu’ils gagnent en autonomie ?
« Les chercheurs avertissent depuis longtemps que trois conditions pourraient conduire à une perte de contrôle : un objectif mal aligné, la capacité à le poursuivre et un environnement qui le permette. Cet été, ces trois éléments se sont réunis dans un système réel, et non en laboratoire », a déclaré Yoshua Bengio, coprésident du groupe scientifique.
« Comme il ne s’agit pas d’une observation isolée d’objectifs mal alignés, cela soulève de sérieuses questions sur la manière dont les agents IA sont actuellement entraînés. »
Les experts soulignent toutefois que cet incident ne permet pas, à lui seul, de conclure que les humains ne peuvent plus contrôler les agents IA. Mais ces derniers deviennent simultanément plus performants, plus autonomes et plus difficiles à surveiller, tout en étant davantage capables d’identifier des failles ou de dissimuler certaines de leurs activités.
Selon le groupe scientifique, une première leçon de l’incident OpenAI-Hugging Face est la nécessité de ne pas négliger les pratiques élémentaires de cybersécurité. Mais les experts identifient également un problème plus profond : certaines méthodes d’entraînement pourraient conduire les agents IA à poursuivre leurs propres objectifs, à contourner délibérément des consignes de sécurité ou à masquer leurs actions.
« Ce n’est pas seulement une question de vitesse », ont-ils souligné. « La question reste ouverte de savoir si les mesures de sécurité conçues aujourd’hui fonctionneront une fois que les agents seront capables de les comprendre et de s’y adapter. En termes simples, le modèle traditionnel de protection est en train de s’effriter. »
Le rapport replace l’incident de Hugging Face dans un ensemble plus large de travaux consacrés au « désalignement agentique », lorsque le comportement d’un agent IA diverge des objectifs ou des intentions humaines, ainsi qu’aux moyens de conserver un contrôle humain sur ces systèmes.
Les experts examinent également les conséquences du passage de modèles d’IA, principalement conçus pour analyser des données et reconnaître des schémas, à des agents capables de prendre des initiatives et d’exécuter des tâches de façon autonome.
Le groupe passe en revue plusieurs mécanismes déjà utilisés dans des domaines à haut risque, notamment l’aviation, la médecine et la cybersécurité : signalement des incidents, contrôles indépendants et dispositifs de protection à plusieurs niveaux.
« Mais ces pratiques pourraient ne pas suffire à mesure que les agents d’IA deviennent plus performants, autonomes et difficiles à surveiller », a averti Qinghua Lu, membre du groupe d’experts.
Le Groupe scientifique international indépendant sur l’intelligence artificielle a été créé par l’Assemblée générale des Nations Unies en août 2025. Il publie des rapports annuels consacrés aux possibilités, aux risques et aux effets de l’IA dans les domaines non militaires, ainsi que des notes thématiques sur les enjeux émergents. Ses travaux doivent notamment alimenter le Dialogue mondial sur la gouvernance de l’intelligence artificielle, qui se tiendra au siège de l’ONU à New York en mai 2027.