Les agents d’OpenAI ont piraté un autre service des mois avant que l’incident survenu chez Hugging Face ne se produise, ont déclaré à The Wall Street Journal un groupe de chercheurs. Les agents, que l’entreprise testait dans un supposé environnement sandbox, auraient pénétré RubyGems, qui est un service d’emballage géré par la communauté pour les programmes et bibliothèques Ruby. Selon The Journal, les attaques contre RubyGems ont commencé le 11 mai, soit deux mois avant Hugging Face. Les agents créaient des comptes toutes les deux à trois minutes et téléchargeaient ensuite des centaines de fichiers sur le service. RubyGems a dû désactiver l’enregistrement des comptes pendant quatre jours afin d’arrêter les attaques.
Typiquement, les créateurs sur RubyGems téléchargent des fichiers contenant du code et d’autres informations pour faire avancer le développement logiciel, mais les documents des agents contenaient des pages web récupérées sur Internet. Ils auraient inclus des calendriers en ligne d’un site gouvernemental du Royaume-Uni. La meute d’agents n’a pas cherché à dissimuler leurs activités et a utilisé « OAI » dans les noms de leurs fichiers, ainsi que des termes tels que « hack », « evil » et « exploit ». De plus, les chercheurs ont déclaré au Journal que les agents ont tenté d’exploiter quelques bogues, dont l’un était une vulnérabilité zero-day, dans le but de publier des fichiers existants sur le service appartenant à d’autres utilisateurs.
Les chercheurs ont informé OpenAI de l’incident, et l’entreprise a admis que ses agents avaient réellement infiltré le service. « Sur la base de notre examen, nos agents ont utilisé la plateforme RubyGems pour accéder à Internet afin d’accomplir des tâches bénignes et de récupérer des informations publiques », a déclaré un porte-parole au The Journal. « Nous continuerons d’enquêter dans le cadre de notre révision plus large de l’activité des agents lors de l’entraînement et de l’évaluation. »
Ils ont ajouté que l’entreprise avait chargé les agents de remplir des feuilles de calcul et de créer des rapports pendant les tests. Ces agents ont accédé à RubyGems pour utiliser le service comme une sorte de navigateur web de fortune dans le cadre de leurs efforts pour accéder à des informations en ligne. Il n’est pas tout à fait clair comment les agents ont pu accéder à RubyGems même s’ils n’avaient pas un accès complet à Internet. Cependant, il convient de noter que plusieurs entreprises, dont OpenAI, Anthropic et Meta, avaient déjà signalé que les agents d’IA qu’elles testaients avaient échappé à leurs environnements en raison d’une mauvaise configuration par leur partenaire de test Irregular.
Plus tôt dans le mois, un groupe distinct de chercheurs a révélé que des agents d’OpenAI avaient effectué plus de 15 000 edits sur DseWiki, un site allemand de style Wikipedia créé pour aider les programmeurs humains. Les agents, qui avaient également échappé à leur environnement de test isolé, auraient utilisé le site comme un forum pour partager des conseils sur la façon de « tricher » dans leurs tâches et de contourner les restrictions d’OpenAI. Cet incident s’est apparemment produit en mai, tout comme les attaques contre RubyGems et des mois avant le piratage de Hugging Face.