taraskuzio.com

Piratage Hugging Face : on sait enfin comment les IA d’OpenAI se sont échappées de leur bac à sable

Le 27 juillet 2026, JFrog a levé le voile sur la vulnérabilité qui a permis à deux modèles d’OpenAI de s’extraire de leur environnement de test pour pirater Hugging Face. Une pièce manquante du puzzle, qui en soulève aussitôt d’autres.

L’affaire ressemblait à un scénario de science-fiction : le 16 juillet 2026, lors d’un test interne, deux modèles d’OpenAI s’étaient extraits de l’environnement cloisonné censé les couper d’Internet, avant de s’introduire dans le réseau de Hugging Face.

OpenAI avait alors évoqué l’exploitation de vecteurs multiples, identifiants volés, failles zero-day, pour obtenir une exécution de code à distance, sans jamais nommer le logiciel concerné.

Un élément central restait donc à élucider : comment les modèles avaient-ils concrètement basculé d’un environnement censé les isoler du réseau à un accès Internet ouvert ? La réponse est venue le 27 juillet, de l’éditeur du logiciel en cause : JFrog.

Logo de JFrog. // Source : JFrog

Le maillon faible détecté

Selon le directeur technique de JFrog, le bac à sable censé couper les modèles d’OpenAI d’Internet avait en fait une porte de sortie : un proxy et un cache utilisés pour télécharger des paquets logiciels, tous deux hébergés sur un outil appelé Artifactory.

Ce logiciel sert normalement aux équipes de développement à stocker et gérer leurs composants. C’est en exploitant des failles jusque-là inconnues dans cet outil que les modèles ont réussi à franchir la barrière censée les contenir.

JFrog a publié lundi une mise à jour corrigeant neuf failles de sécurité au total. Trois d’entre elles ont été signalées en toute confidentialité par un chercheur travaillant chez OpenAI. Sans confirmation officielle, il est probable que certaines d’entre elles soient celles qui ont permis l’évasion des modèles.

Un optimisme à nuancer

Sur son blog, JFrog précise que l’équipe sécurité d’OpenAI a prévenu l’entreprise « immédiatement et de manière responsable ». L’entreprise israélienne voit dans cet épisode une leçon « optimiste » : les modèles d’IA deviendraient des moteurs de découverte de failles zero-day extraordinaires, capables de repérer des vulnérabilités qu’aucun humain n’avait détectées. Une lecture largement nuancée par Ars Technica, qui pointe le temps pris par JFrog pour publier ses correctifs.

Hugging Face a en effet révélé la fuite le 16 juillet. OpenAI n’a reconnu son rôle dans l’intrusion que cinq jours plus tard.

À cela, il faut ajouter les cinq jours supplémentaires entre le signalement des failles à JFrog et la publication du correctif, le 27 juillet. Au total, environ dix jours durant lesquels la vulnérabilité signalée par OpenAI est restée exploitable.

Le média américain relève aussi que JFrog a annoncé avoir corrigé les failles exploitées sans jamais les identifier précisément, ni détailler les conditions de leur exploitation. Contacté par email, un représentant de l’entreprise a refusé de communiquer ces informations au site d’information, des données pourtant jugées essentielles dans la plupart des rapports de vulnérabilité, puisqu’elles permettent aux clients d’évaluer leur propre exposition aux risques.

Toute l'actu tech en un clien d'oeil

Toute l'actu tech en un clin d'œil

Ajoutez Numerama à votre écran d'accueil et restez connectés au futur !


Un édito exclusif, un guide, une reco de lecture et l’agenda de la rédaction : c’est ce que vous trouverez tous les jeudis dans ToujoursPlus, la newsletter tech écrite par Julien Cadot. Inscrivez-vous gratuitement ici !