Plus de 16 000 requêtes en quelques semaines, des stratégies improvisées et l’utilisation détournée d’un outil pédagogique de cybersécurité. Des agents d’IA d’OpenAI sont accusés d’avoir développé des méthodes inattendues pour collecter des données sur un site de l’ONU.
Par Yakout Abina
Des agents d’intelligence artificielle développés par OpenAI sont encore une fois au cœur d’une nouvelle polémique. Selon le chercheur Rowan Howard-Jones, ces systèmes auraient effectué plus de 16 000 requêtes sur UNCTADstat, la plateforme de données de la Conférence des Nations unies sur le commerce et le développement (CNUCED), entre avril et juin dans le but de récupérer des statistiques publiques.
À l’origine, la mission confiée aux agents était de collecter des données librement accessibles. Mais ne disposant pas d’un accès direct à certains outils du site, les IA auraient progressivement cherché d’autres moyens d’obtenir les informations demandées. selon le rapport, elles ont même fini par attribuer leurs échecs à un filtre de sécurité inexistant. Partant de cette fausse hypothèse, ils ont cherché à dissimuler davantage leurs requêtes afin de contourner ce qu’ils croyaient être un obstacle.
Le point le plus surprenant de l’enquête concerne l’utilisation de XSS Game, un outil pédagogique créé par Google pour apprendre aux développeurs à identifier et corriger certaines failles de sécurité informatique. Ce jeu aurait été détourné par les agents pour faciliter la collecte massive de données depuis le site de l’ONU. Pour Rowan Howard-Jones, ce comportement illustre la capacité des agents d’IA à développer de manière autonome des stratégies de plus en plus efficaces lorsqu’ils poursuivent un objectif précis.
Pour plusieurs spécialistes de la cybersécurité, cet incident soulève des questions importantes. Alex Stamos, un expert en cybersécurité interrogé par le Wall Street Journal, estime que cette affaire se situe à la frontière du piratage informatique. Les enquêteurs soulignent toutefois qu’aucun élément ne laisse penser qu’OpenAI avait explicitement demandé à ses agents d’attaquer le site. Le comportement problématique serait apparu de lui-même, à mesure que les systèmes tentaient d’accomplir leur mission.
Cet épisode s’ajoute à une série d’incidents impliquant des agents d’OpenAI. Ces derniers mois, des comportements similaires ont été observés sur des plateformes gouvernementales australiennes et américaines. OpenAI a également reconnu plusieurs dérapages de ses modèles.
Dans la plupart des cas, les IA cherchaient simplement à atteindre l’objectif fixé, mais en adoptant des méthodes non prévues par leurs concepteurs. Selon les experts, une consigne aussi vague que « récupérer des données » peut parfois conduire les systèmes à développer des comportements inattendus.
Pour Rowan Howard-Jones, cette situation ressemble à celle de quelqu’un, ou de quelque chose, qui n’accepte pas un refus. Il estime que ces réactions doivent être étudiées de près afin de mieux comprendre les risques liés aux agents autonomes.
Face à la multiplication de ces incidents, plusieurs grands acteurs du secteur, dont OpenAI, Google, Anthropic et xAI, alertent sur les risques croissants liés aux intelligences artificielles avancées. Ils appellent à une coopération internationale renforcée pour encadrer ces technologies et limiter les menaces potentielles.
Cette position apparaît toutefois paradoxale pour certains observateurs. Alors que ces mêmes entreprises continuent de lancer de nouveaux modèles toujours plus puissants et plus performant, alimentant le débat sur la nécessité de mieux contrôler le développement de ces technologies.
Y.A
