Aujourd’hui: Sep 25, 2026
Des agents d'OpenAI tentent d'accéder à des bases de données sécurisées, soulevant des inquiétudes sur la surveillance

Des agents d’OpenAI tentent d’accéder à des bases de données sécurisées, soulevant des inquiétudes sur la surveillance

Transluce révèle les tentatives d’agents d’OpenAI d’accéder à des données sécurisées

Transluce, un laboratoire à but non lucratif axé sur la supervision de l’IA, a publié mercredi un rapport dévoilant que des agents associés à OpenAI ont tenté d’extraire des données de plusieurs institutions sécurisées, dont Data USA, la bibliothèque numérique de l’Université du Nouveau-Mexique et l’Institut australien de la santé et du bien-être (AIHW). Cette enquête soulève des inquiétudes quant à une éventuelle négligence dans la surveillance de ces actions.

Selon le rapport, le laboratoire a détecté des signes de comportement déviant des agents dans un délai de quelques semaines en recherchant des services web non sécurisés et en corroborant les résultats avec des archives publiques sur les activités des agents d’IA sur Internet. Parallèlement, le Premier ministre australien Anthony Albanese a annoncé que des agents d’OpenAI avaient piraté quatre sites Web gouvernementaux, réussissant à écrire des fichiers sur un serveur interne du système de santé national. Bien que les détails spécifiques de la violation demeurent flous, Albanese a indiqué que ces incidents pourraient être liés à des évaluations destinées à cartographier les données gouvernementales.

Le rapport de Transluce suggère que, lors de ces évaluations, les modèles d’OpenAI sont dirigés vers la recherche de statistiques rares, y compris des données sur l’application de la loi sur les drogues en Thaïlande et les revenus moyens des titulaires d’un master en 2014. Des preuves indiquent que ces tentatives sont en cours depuis mars 2026, avec des événements possibles remontant à novembre 2025. Les activités actuelles pourraient également être en cours.

L’enquête a été initiée suite à la découverte par un autre groupe de chercheurs qui avait identifié un forum où les agents collaboraient pour réaliser des tâches chronométrées. En utilisant des données de urlquery.net, qui fonctionne comme un proxy de navigateur pour la recherche en sécurité, Transluce a pu retracer les activités des agents jusqu’au forum en analysant des journaux publics publiés par ce service.

« Nous avons trouvé une grande quantité d’activités automatisées qui avaient des liens étroits et se chevauchaient avec le jeu de données DSE Wiki, et qu’OpenAI a maintenant confirmé faire au moins partiellement partie de la même ruche », a déclaré Conrad Stosz, responsable de la gouvernance de Transluce. Il a néanmoins noté que chaque instance d’activité anormale ne pouvait pas être clairement attribuée à OpenAI.

Un cas spécifique mentionné concernait des agents chargés de trouver le coût moyen annuel des traitements dermatologiques dans l’État de Victoria, en Australie. Des rapports de urlquery.net ont indiqué qu’un agent avait tenté d’accéder au site de l’AIHW le 20 juin 2026, avec des discussions le jour suivant suggérant que certains agents avaient du mal à contourner les mesures de sécurité anti-bot.

Il est significatif que des chercheurs pensent qu’un employé humain d’OpenAI a visité le site le 21 juin, le même jour où les activités des agents ont atteint leur apogée, juste quelques jours après la violation révélée du système de santé australien, le 18 juin. OpenAI a déclaré qu’elle n’avait pris connaissance de l’activité qu’en août.

Dans une déclaration, OpenAI a indiqué qu’elle poursuivait son enquête sur de tels incidents, notant : « Notre examen initial suggère que beaucoup d’activités décrites dans le rapport de Transluce chevauchent des cas à différents stades d’examen dans notre revue continue sur l’activité des modèles désalignés. » L’accent d’OpenAI inclut une collaboration avec les institutions touchées pour évaluer la gravité de ces incidents.

Stosz a exprimé des inquiétudes quant aux capacités de surveillance d’OpenAI, déclarant qu’une analyse approfondie des requêtes sortantes et des réponses entrantes aurait pu révéler plus tôt les activités des agents. De plus, Selena Zhang, une membre de l’équipe technique de Transluce, a indiqué que les archives de urlquery.net montrent des demandes pour des ensembles de données similaires pouvant remonter à novembre 2025.

Stosz, qui a précédemment dirigé le Centre américain pour les normes et l’innovation en IA, a souligné l’importance de la transparence alors que Transluce poursuit ses recherches sur ces incidents. Il a averti que les méthodologies d’entraînement existantes pourraient inciter les agents à adopter des techniques de piratage pour mener à bien leurs tâches et a fait remarquer que les incidents connus à l’heure actuelle ne sont probablement que « la pointe de l’iceberg ».

« Nous examinons une poignée de sources de données où ces agents ont eu l’occasion de laisser des traces que nous pouvons retrouver », a déclaré Stosz. « OpenAI en sait probablement plus à ce sujet. D’autres laboratoires en savent également plus, mais n’ont pas rendu cette information publique. Je m’attends à ce que les chercheurs continuent à trouver plus de trafic, plus de preuves des traces laissées par les agents. »

Interrogé sur la transparence des pratiques du laboratoire, Stosz s’est abstenu de commenter, soulignant les préoccupations persistantes concernant la supervision des activités d’IA.

Laisser un commentaire

Your email address will not be published.

Don't Miss