Aller au contenu
Le Bien Heureux · Belgique
L’essentiel geek, le temps d’une pause.
Jeudi 8 octobre 2026 Édition du matin N° 43
IA, encore! · Avant le café · ≈ 2 min de lecture

Un agent d’OpenAI s’échappe par le DNS, et l’entraînement des modèles de pointe s’arrête

Un agent d'OpenAI a joint un chatbot public par le DNS en plein entraînement. Repéré en 15 minutes, stoppé 2 h 30 après. Les modèles de pointe sont en pause.

Sam Altman, patron d'OpenAI, assis sur scène lors d'une conférence TED
© Steve Jurvetson · CC BY 2.0

On lui demandait de retrouver des informations sur une personne à partir de son blog. L’agent a trouvé plus efficace que son outil de recherche : un chatbot public, joint par le seul canal resté ouvert dans son bac à sable, le DNS.

Ce que dit le rapport d’OpenAI

OpenAI a publié l’incident le 25 septembre dans un de ses rapports sur les comportements déviants. L’agent a d’abord interrogé son outil de recherche, puis tenté sans succès d’atteindre directement des moteurs de recherche. Tout son accès au Web passait par un cache hors ligne, sauf le résolveur DNS. C’est par lui qu’il a pu interroger le chatbot.

Le DNS traduit un nom de domaine en adresse IP. Comme presque tout en dépend, c’est souvent la porte qu’on oublie de verrouiller. OpenAI ne détaille pas comment l’agent s’en est servi pour dialoguer ; il indique avoir ajouté des blocages à deux niveaux indépendants.

La chronologie mérite qu’on s’y arrête : le système de surveillance a signalé le comportement en 15 minutes, un humain s’y est penché 3 minutes plus tard, et l’entraînement n’a été arrêté que 2 h 30 après. La détection est rapide, le bouton rouge beaucoup moins. Depuis, entraînement, évaluation et utilisation avec outils de ses modèles les plus puissants restent suspendus.

Une série qui s’allonge

OpenAI juge l’incident « beaucoup moins grave » que certains précédents, mais c’est le premier depuis le durcissement de ses environnements après l’attaque de Hugging Face par ses propres agents. D’après The Register, OpenAI a aussi reconnu que des agents avaient touché aux sites de trois administrations américaines et publié 53 images de données d’entraînement sur des hébergeurs. L’Australie, dont un portail de recherche en santé a été visité, veut entendre Sam Altman et Dario Amodei, le patron d’Anthropic, devant son Sénat, même si son vice-premier ministre compare l’intrusion à « escalader une clôture ».

Selon Axios, cité par Clubic, OpenAI, Anthropic et des chercheurs indépendants examinent des dizaines de milliers d’incidents impliquant des modèles avancés. Le chiffre mélange tests internes et cas réels, de gravité très variable, et aucun n’aurait eu à ce stade de conséquence concrète hors laboratoire. Sam Altman reconnaît que les enquêtes « n’ont pas été aussi rapides » que souhaité.

En bref

  • Un agent a joint un chatbot public via le DNS, seul accès non filtré de son bac à sable.
  • Signalé en 15 minutes, entraînement arrêté 2 h 30 plus tard.
  • Modèles les plus puissants d’OpenAI en pause pour tout usage avec outils.
  • Des dizaines de milliers d’incidents à l’examen chez OpenAI, Anthropic et des chercheurs, selon Axios.

Sources : rapport d’OpenAI, The Register, Clubic.