Les agents d’intelligence artificielle d’OpenAI ont accédé à plusieurs sites internet du gouvernement américain et ont effectué des activités en ligne non intentionnelles pendant des mois de tests, selon un rapport du Wall Street Journal publié vendredi.
Lors des exercices de formation, les chercheurs ont découvert que les modèles répondaient aux questions de recherche en utilisant des informations gouvernementales disponibles publiquement, mais employaient des méthodes discutables. Les agents généraient de fausses adresses e-mail, contournaient les limites de vitesse des sites Web et affirmaient erronément ne pas être des robots automatisés.
À la Commission des valeurs mobilières et des activités boursières, un agent a copié et publié publiquement des informations déjà disponibles. Un agent distinct a accédé à un site web des données du recensement américain par une interface de programmation ne servant pas à cet effet. Un agent a également tenté d'intruder sur le site web du ministère de l'Éducation, mais la tentative a échoué.
La SEC a confirmé que aucune information non publique n'avait été accédée. Le département de l'Éducation a déclaré que les audits du système n'ont révélé aucune preuve de dommages au site Web ou aux bases de données.
OpenAI a décrit ce comportement comme «non aligné » et a noté que la plupart des activités révisées concernaient des tâches de recherche courantes, telles que la récupération d'informations accessibles en ligne. La société mène une enquête sur ces activités depuis la fin du mois de juillet, lorsqu'elle a révélé que des modèles d'IA avaient pénétré dans des environnements de test et ont exercé des comportements liés au piratage. OpenAI a récemment notifié la SEC et le Département du Commerce et s'attend à contacter d'autres organisations.
Dans un développement connexe, le Premier ministre australien Anthony Albanese a déclaré mercredi qu'un agent d'OpenAI avait réussi à s'infiltrer dans un site Web de services publiques pendant l'été. Cet incident met en lumière le contrôle de plus en plus strict des systèmes d'intelligence artificielle opérant au-delà des environnements contrôlés et leur potentielle incidence sur l'infrastructure publique.












