Un groupe de chercheurs en cybersécurité a récemment démontré la capacité d’un modèle d’intelligence artificielle à contourner les défenses d’une des entreprises les plus influentes du secteur, OpenAI. En s’appuyant sur le modèle Claude d’Anthropic, les chercheurs ont exploité deux vulnérabilités en chaîne pour accéder à plusieurs comptes employés de ChatGPT, révélant ainsi des lacunes critiques dans la chaîne de traitement d’images du forum communautaire d’OpenAI.
Une faille au cœur du forum communautaire
Le point d’entrée de l’attaque était le logiciel tiers Discourse, qui alimente le forum d’OpenAI. Lorsqu’un utilisateur téléchargeait une image au format HEIF ou HEIC – les formats natifs des iPhones – le système déclenchait une série d’outils de conversion. L’image était d’abord traitée par ImageMagick, puis, faute de prise en charge native du format Apple, était transmise à la bibliothèque libheif pour le décodage.
Une faille de mémoire, déjà corrigée dans libheif mais jamais enregistrée sous forme de CVE, permettait à un attaquant de manipuler la façon dont les images étaient superposées. En soumettant une image spécialement conçue, les chercheurs ont provoqué un mauvais calcul de la position d’une image sur une autre, ouvrant ainsi une porte d’entrée au serveur.
Le rôle décisif de Claude Opus 5
Les chercheurs utilisaient initialement une version antérieure du modèle Claude, nommée Opus 4.8, qui n’a pas réussi à générer un exploit fonctionnel. La sortie d’Opus 5, quelques heures plus tard, a changé la donne : le même problème soumis au nouveau modèle a abouti à la création d’un code d’exploitation viable. Cette évolution montre comment l’amélioration des capacités de génération de code par les modèles IA peut accélérer le processus de découverte d’exploits.
Une fois à l’intérieur du serveur Discourse, les chercheurs ont identifié une seconde vulnérabilité qui leur a permis de prendre le contrôle des comptes ChatGPT et Codex de plusieurs employés d’OpenAI. Parmi ces comptes, certains étaient liés à l’organisation GitHub de l’entreprise, offrant ainsi un accès encore plus large aux ressources internes.
Réactions d’OpenAI et implications pour la sécurité IA
OpenAI a rapidement corrigé les failles signalées et a attribué une récompense de 6 500 $ aux chercheurs dans le cadre de son programme de bug‑bounty. L’incident survient à un moment où les géants de l’IA font face à une pression croissante concernant la sécurité et la fiabilité de leurs modèles.
Le fait que des outils accessibles à 200 $ par mois puissent être employés pour compromettre une infrastructure de pointe soulève des questions sur la résilience des systèmes face à des acteurs non étatiques. Un expert en sécurité a souligné que si une petite équipe pouvait réussir une telle intrusion, les menaces provenant d’acteurs nationaux pourraient être encore plus redoutables.
Par ailleurs, la distinction entre les modèles soumis à des restrictions d’exportation et ceux qui restent ouverts devient cruciale. Alors que les versions les plus avancées de Claude, comme Mythos 5, sont soumises à des contrôles stricts, Opus 5 demeure disponible sans restriction, ce qui facilite son utilisation à des fins de recherche ou, potentiellement, d’abus.
Le paysage des modèles open‑source
Des organisations de sécurité ont constaté que les modèles open‑source rattrapent rapidement leurs homologues propriétaires en matière de capacités de hacking. Par exemple, le modèle GLM‑5.2 d’une société chinoise se situe à quelques mois seulement de la performance des dernières versions de GPT et Claude.
Cette dynamique indique que la barrière d’entrée pour développer des exploits diminue, rendant la cybersécurité des systèmes d’IA plus complexe. Les experts soulignent que des travaux qui prenaient autrefois des mois peuvent désormais être réalisés en quelques jours grâce à l’assistance d’IA.
- Vulnérabilité initiale : mauvaise gestion des images HEIF/HEIC via libheif.
- Exploitation facilitée par Claude Opus 5, capable de générer du code d’exploitation.
- Accès aux comptes internes de ChatGPT et Codex, incluant des droits sur le dépôt GitHub d’OpenAI.
- Réponse rapide d’OpenAI : correctifs déployés et récompense de bug‑bounty attribuée.
En conclusion, cet incident met en lumière la nécessité pour les entreprises du secteur de renforcer leurs chaînes d’approvisionnement logicielles et d’adopter des processus de suivi des vulnérabilités plus rigoureux. La capacité des modèles d’IA à automatiser la découverte d’exploits représente un nouveau vecteur de risque qui devra être intégré aux stratégies de défense dès maintenant.