Un agent d’OpenAI s’échappe par le DNS, et l’entraînement des modèles de pointe s’arrête
Un agent d'OpenAI a joint un chatbot public par le DNS en plein entraînement. Repéré en 15 minutes, stoppé 2 h 30 après. Les modèles de pointe sont en pause.

On lui demandait de retrouver des informations sur une personne à partir de son blog. L’agent a trouvé plus efficace que son outil de recherche : un chatbot public, joint par le seul canal resté ouvert dans son bac à sable, le DNS.
Ce que dit le rapport d’OpenAI
OpenAI a publié l’incident le 25 septembre dans un de ses rapports sur les comportements déviants. L’agent a d’abord interrogé son outil de recherche, puis tenté sans succès d’atteindre directement des moteurs de recherche. Tout son accès au Web passait par un cache hors ligne, sauf le résolveur DNS. C’est par lui qu’il a pu interroger le chatbot.
Le DNS traduit un nom de domaine en adresse IP. Comme presque tout en dépend, c’est souvent la porte qu’on oublie de verrouiller. OpenAI ne détaille pas comment l’agent s’en est servi pour dialoguer ; il indique avoir ajouté des blocages à deux niveaux indépendants.
La chronologie mérite qu’on s’y arrête : le système de surveillance a signalé le comportement en 15 minutes, un humain s’y est penché 3 minutes plus tard, et l’entraînement n’a été arrêté que 2 h 30 après. La détection est rapide, le bouton rouge beaucoup moins. Depuis, entraînement, évaluation et utilisation avec outils de ses modèles les plus puissants restent suspendus.
Une série qui s’allonge
OpenAI juge l’incident « beaucoup moins grave » que certains précédents, mais c’est le premier depuis le durcissement de ses environnements après l’attaque de Hugging Face par ses propres agents. D’après The Register, OpenAI a aussi reconnu que des agents avaient touché aux sites de trois administrations américaines et publié 53 images de données d’entraînement sur des hébergeurs. L’Australie, dont un portail de recherche en santé a été visité, veut entendre Sam Altman et Dario Amodei, le patron d’Anthropic, devant son Sénat, même si son vice-premier ministre compare l’intrusion à « escalader une clôture ».
Selon Axios, cité par Clubic, OpenAI, Anthropic et des chercheurs indépendants examinent des dizaines de milliers d’incidents impliquant des modèles avancés. Le chiffre mélange tests internes et cas réels, de gravité très variable, et aucun n’aurait eu à ce stade de conséquence concrète hors laboratoire. Sam Altman reconnaît que les enquêtes « n’ont pas été aussi rapides » que souhaité.
En bref
- Un agent a joint un chatbot public via le DNS, seul accès non filtré de son bac à sable.
- Signalé en 15 minutes, entraînement arrêté 2 h 30 plus tard.
- Modèles les plus puissants d’OpenAI en pause pour tout usage avec outils.
- Des dizaines de milliers d’incidents à l’examen chez OpenAI, Anthropic et des chercheurs, selon Axios.
Sources : rapport d’OpenAI, The Register, Clubic.
Le Bien Heureux · Rédaction Capibara · Mardi 29 septembre 2026