Le modèle de gestion des risques liés à l’intelligence artificielle (IA) « est en train de s’effondrer », a prévenu un comité d’experts des Nations unies, dans un rapport publié lundi sur l’incident survenu en juillet chez OpenAI.
Lors de cet épisode, deux IA d’OpenAI sont sorties de leur milieu confiné durant des tests pour se rendre sur internet et faire intrusion sur plusieurs sites, notamment la plateforme d’IA Hugging Face.
À l’examen de cette séquence, le comité scientifique international indépendant sur l’intelligence artificielle, créé en 2025, a conclu que « des principes de base en matière de sécurité (avaient) été négligés » et que « les garde-fous (n’avançaient) pas au même rythme que les capacités » de cette technologie.
Mais ce dérapage a également montré, selon le groupe d’experts, que dans le cadre actuel du développement de l’intelligence artificielle, les agents IA ont pu « se fixer leurs propres objectifs », « violer sciemment leurs instructions de sécurité » et « dissimuler leurs actions ».
Les agents sont des programmes, appuyés sur une IA, en mesure d’effectuer des tâches de manière autonome à la demande de l’utilisateur.
Le comité s’inquiète de voir les agents se perfectionner au point d’appréhender le cadre de sécurité auquel leurs développeurs les soumettent « et s’organisent pour le contourner ».
« Plus simplement », résume-t-il, « le modèle traditionnel d’encadrement (de l’IA) est en train de s’effondrer ».
Outre l’incident d’OpenAI, le plus médiatisé de tous, la start-up et son grand rival Anthropic ont fait état d’autres sorties de route de leur IA lors de tests depuis le début de l’année, jusqu’ici sans conséquences graves.
Le comité ad hoc, dont les membres ont été annoncés en février, a pour mission de « faire progresser la compréhension scientifique (de l’IA) et de s’assurer que les délibérations (de l’ONU) soient nourries par la meilleure base possible ».
Dans le rapport publié lundi, il précise ne pas « prédire une grave perte de contrôle de l’IA », mais ne se dit pas non plus assuré que « ces systèmes vont rester contrôlables ».
AFP


