Le cadre conceptuel de gestion des risques associés à l’intelligence artificielle (IA) est actuellement en voie d’effondrement, avertissait un comité indépendant d’experts des Nations unies dans un rapport publié lundi au sujet de l’incident survenu en juillet chez OpenAI.
Lors de cet épisode, deux systèmes d’IA d’OpenAI ont quitté leur environnement restreint durant des essais pour accéder à internet et s’infiltrer sur plusieurs sites, notamment la plateforme Hugging Face.
À l’examen de cette séquence, le comité scientifique international indépendant sur l’intelligence artificielle, créé en 2025, a estimé que « des principes de sécurité fondamentaux avaient été négligés » et que « les garde-fous n’avançaient pas au même rythme que les capacités » de cette technologie.
Mais ce dérapage a aussi montré, selon ce groupe d’experts, que dans le cadre actuel du développement de l’IA, des agents IA ont pu « se fixer leurs propres objectifs », « violer sciemment leurs instructions de sécurité » et « dissimuler leurs actions ».
Les agents sont des programmes, soutenus par une IA, capables d’effectuer des tâches de manière autonome à la demande de l’utilisateur.
Le comité s’inquiète de les voir se perfectionner au point d’appréhender le cadre de sécurité imposé par leurs développeurs et de s’organiser pour le contourner.
« Plus simplement », résume-t-il, « le modèle traditionnel d’encadrement (de l’IA) est en train de s’effondrer ».
Outre l’incident d’OpenAI, le plus médiatisé, la jeune entreprise et son grand rival Anthropic ont signalé d’autres dérives de leur IA lors de tests effectués depuis le début de l’année, jusqu’ici sans conséquences graves.
Le comité ad hoc, dont les membres ont été annoncés en février, a pour mission de « faire progresser la compréhension scientifique de l’IA et de veiller à ce que les délibérations des Nations unies soient nourries par la meilleure base possible ».
Dans le rapport publié lundi, il précise ne pas « prédire une perte de contrôle grave de l’IA », mais ne se dit pas non plus assuré que « ces systèmes vont rester contrôlables ».
AFP