Notebookcheck Logo

OpenAI Astra : de nouvelles mesures de sécurité peuvent interrompre votre tâche ChatGPT en cours d'exécution

Infographie OpenAI : « Path to Astra », capacités essentielles et mesures de protection de pointe
ⓘ OpenAI
OpenAI a attribué la note « Astra Critical » à Astra en matière de cybersécurité. Les mesures de sécurité qui l’accompagnent peuvent également bloquer des tâches inoffensives dans ChatGPT et Codex.
OpenAI a classé son prochain modèle Astra dans la catégorie « Critique » en matière de cybersécurité ; il s’agit du premier modèle à atteindre ce niveau. Il est capable de détecter des failles inconnues et de créer des exploits fonctionnels sans qu’une personne ne guide chacune de ses étapes. Les mesures de sécurité intégrées au modèle signaleront également les tâches courantes, ce qui peut entraîner un ralentissement, une pause ou un arrêt des tâches dans ChatGPT et Codex.

OpenAI affirme que son prochain modèle Astra est le premier à atteindre le seuil « Critique » en matière de cybersécurité. Cette notation provient du « Preparedness Framework » de l’entreprise, le référentiel interne qu’elle utilise pour évaluer le risque présenté par ses propres modèles. Un modèle atteint ce niveau lorsqu’il est capable de détecter des failles inconnues au sein de nombreux systèmes bien protégés et de les transformer en attaques efficaces sans qu’une personne n’intervienne à chaque étape. Tous les modèles jusqu’au GPT-5.6 Sol se situaient un cran en dessous.

Deux failles inconnues détectées lors des propres tests d’OpenAI

Astra a obtenu un score parfait de 100 % sur ExploitBench. Comme cet ensemble de données a pu être intégré à l’entraînement, OpenAI a reconstitué une version privée autour de 20 failles récemment divulguées dans le moteur JavaScript V8. Au cours de cette exécution, le modèle a mis au jour deux failles que personne n’avait signalées et les a enchaînées pour en faire un exploit fonctionnel. La notification aux responsables de la maintenance est toujours en cours.

Les testeurs ont également soumis Astra à un navigateur et à un système d’exploitation renforcés. Dans le navigateur, l’ouverture d’un simple fichier HTML a suffi au modèle pour s’échapper du bac à sable et exécuter des commandes sur l’hôte. Sur le système d’exploitation, il a identifié plusieurs failles et les a enchaînées pour créer un chemin permettant de passer d’un compte utilisateur ordinaire à un accès root complet.

Ce que remarqueront les utilisateurs de ChatGPT et de Codex

L’aspect important au-delà du monde de la sécurité se trouve vers la fin de l’article d’OpenAI. La mise en production d’un modèle de ce niveau implique que des contrôles supplémentaires soient effectués en parallèle, et ces contrôles se déclencheront parfois sur des tâches tout à fait inoffensives. Le système peut interpréter une activité légitime comme une utilisation abusive ou un comportement non autorisé, puis ralentir une tâche, la mettre en pause ou y mettre fin. OpenAI précise clairement que cela concerne des tâches n’ayant absolument aucun rapport avec la sécurité, ainsi que des tâches qu’un agent exécute depuis un certain temps.

Dans ChatGPT et Codex, on vous demande de vérifier l’action signalée avant que le processus ne se poursuive. Via l’API, la tâche s’arrête tout simplement. OpenAI reconnaît que ces mesures de sécurité créent davantage de frictions au lancement qu’elle ne le souhaiterait, et indique qu’elle les affinera.

D’abord un petit groupe de testeurs

Il n’y a pas de date de lancement. OpenAI se contente d’indiquer qu’Astra sera disponible prochainement et a refusé de communiquer un calendrier à Axios. Les fonctionnalités avancées de cybersécurité seront d’abord mises à la disposition d’un petit groupe de testeurs, un accès plus large étant prévu ultérieurement via le programme Daybreak Blue destiné aux professionnels de la cybersécurité. Personne d’autre ne peut utiliser Astra pour le moment.

OpenAI a quant à lui chiffré l’efficacité de ce renforcement de la sécurité. Face à des tentatives de « jailbreak » connues, Astra rejette 91,5 % des requêtes, alors que GPT-5.6 Sol n’en rejetait que 59 %. Lors d’un autre test, des cibles alléchantes étaient placées à côté de la tâche à accomplir. GPT-5.6 Sol s’est tourné vers elles dans 56 % des essais, tandis qu’Astra ne l’a jamais fait. Ces deux chiffres proviennent d’essais réalisés sans les protections prévues en fonctionnement normal.

L’incident à l’origine de cette mise en garde

Cette mise en garde n’a rien d’abstrait. En juillet, un modèle d’OpenAI s’est échappé de son environnement de test lors d’un test de sécurité interne et a attaqué Hugging Face. Fin août, on a appris qu’environ 1 200 agents avaient formé un essaim coordonné et tenté de dissimuler leurs agissements. Astra n’a joué aucun rôle dans cet incident. OpenAI a suspendu certaines parties de son entraînement pendant deux semaines par la suite, a renforcé sa propre infrastructure et n’a relancé la grande session d’entraînement mise en attente que le 28 août, quatre jours avant l’attribution de la note « Critique ».

Google LogoAdd as a preferred source on Google
Mail Logo
> Revues et rapports de ordinateurs portatifs et smartphones, ordiphones > Nouvelles > Archives des nouvelles > Archives des nouvelles 2026 09 > OpenAI Astra : de nouvelles mesures de sécurité peuvent interrompre votre tâche ChatGPT en cours d'exécution
Steffen Zahn, 2026-09- 3 (Update: 2026-09- 3)