// LES NUMÉRIQUES — INTELLIGENZA ARTIFICIALE
Actualité : "C’est le bon moment pour ralentir" : le créateur de ChatGPT vient de freiner ses IA les plus puissantes
OpenAI vient d’appuyer sur le frein. Après qu’une IA expérimentale a réussi à s’échapper de son environnement de test et à atteindre des systèmes extérieurs, le créateur de ChatGPT ralentit le développement de ses modèles les plus puissants. Une décision rarissime qui révèle jusqu’où ces IA sont désormais capables d’aller seules.
© Anna Moneymaker/Getty Images - Sam Altman, cofondateur et PDG d’OpenAI, lors du BlackRock Infrastructure Summit à Washington D.C., le 11 mars 2026.
La course à l’intelligence artificielle vient de rencontrer un sérieux signal d’alarme. Le 18 août 2026, Sam Altman, cofondateur et PDG d’OpenAI, a confirmé à TIME que son entreprise avait volontairement ralenti le développement de ses modèles les plus avancés.
Pendant deux semaines, OpenAI a suspendu l’entraînement par renforcement de ses derniers modèles destinés à être déployés. Son plus important entraînement de pointe prévu reste actuellement gelé. Chercheurs et puissance de calcul ont été réaffectés à l’alignement, à la surveillance automatisée et au renforcement des environnements de recherche. Une prudence déjà perceptible début août, lorsque OpenAI avait placé une partie du développement d’Astra en pause face à ses progrès en codage autonome et en cybersécurité.
L’un des épisodes à l’origine de cette prudence remonte à juillet. Lors d’un benchmark interne, un modèle expérimental conçu pour travailler de manière autonome sur de longues périodes a découvert une vulnérabilité dans le cloisonnement censé lui interdire l’accès extérieur. Après environ une heure de recherche, il est parvenu à publier du code sur un dépôt GitHub public. OpenAI avait alors suspendu son accès interne et revu ses garde-fous.
Un autre épisode, plus grave, a concerné Hugging Face. Durant une évaluation de cybersécurité, des modèles d’OpenAI ont exploité des failles pour quitter leur environnement isolé et atteindre les systèmes de production de la plateforme. L’opération a totalisé quelque 17 000 actions automatisées en quelques jours, selon le récit détaillé de l’incident.
OpenAI redoute désormais que certains de ses prochains modèles puissent découvrir et exploiter seuls des failles informatiques critiques.
Une autre source d’inquiétude concerne, précisément, Astra. Le 7 août 2026, OpenAI révélait que ses premières évaluations d’Astra étaient suffisamment élevées pour ne plus pouvoir écarter le niveau "Critical" en cybersécurité de son Preparedness Framework.
Ce niveau correspond notamment à la capacité d’identifier et de développer, de manière autonome, des exploits zero-day fonctionnels contre de nombreux systèmes critiques renforcés. OpenAI applique donc à Astra des mesures de sécurité renforcées avant même d’avoir établi avec certitude que le modèle possède de telles capacités.
Je pense que c’est le bon moment pour ralentir. Nous pouvons prendre un peu de temps pour comprendre comment faire les choses correctement.