OpenAI Astra : de nouvelles mesures de sécurité peuvent interrompre votre tâche ChatGPT en cours d'exécution

OpenAI affirme que son prochain modèle Astra est le premier à atteindre le seuil « Critique » en matière de cybersécurité. Cette notation provient du « Preparedness Framework » de l’entreprise, le référentiel interne qu’elle utilise pour évaluer le risque présenté par ses propres modèles. Un modèle atteint ce niveau lorsqu’il est capable de détecter des failles inconnues au sein de nombreux systèmes bien protégés et de les transformer en attaques efficaces sans qu’une personne n’intervienne à chaque étape. Tous les modèles jusqu’au GPT-5.6 Sol se situaient un cran en dessous.
Deux failles inconnues détectées lors des propres tests d’OpenAI
Astra a obtenu un score parfait de 100 % sur ExploitBench. Comme cet ensemble de données a pu être intégré à l’entraînement, OpenAI a reconstitué une version privée autour de 20 failles récemment divulguées dans le moteur JavaScript V8. Au cours de cette exécution, le modèle a mis au jour deux failles que personne n’avait signalées et les a enchaînées pour en faire un exploit fonctionnel. La notification aux responsables de la maintenance est toujours en cours.
Les testeurs ont également soumis Astra à un navigateur et à un système d’exploitation renforcés. Dans le navigateur, l’ouverture d’un simple fichier HTML a suffi au modèle pour s’échapper du bac à sable et exécuter des commandes sur l’hôte. Sur le système d’exploitation, il a identifié plusieurs failles et les a enchaînées pour créer un chemin permettant de passer d’un compte utilisateur ordinaire à un accès root complet.
Ce que remarqueront les utilisateurs de ChatGPT et de Codex
L’aspect important au-delà du monde de la sécurité se trouve vers la fin de l’article d’OpenAI. La mise en production d’un modèle de ce niveau implique que des contrôles supplémentaires soient effectués en parallèle, et ces contrôles se déclencheront parfois sur des tâches tout à fait inoffensives. Le système peut interpréter une activité légitime comme une utilisation abusive ou un comportement non autorisé, puis ralentir une tâche, la mettre en pause ou y mettre fin. OpenAI précise clairement que cela concerne des tâches n’ayant absolument aucun rapport avec la sécurité, ainsi que des tâches qu’un agent exécute depuis un certain temps.
Dans ChatGPT et Codex, on vous demande de vérifier l’action signalée avant que le processus ne se poursuive. Via l’API, la tâche s’arrête tout simplement. OpenAI reconnaît que ces mesures de sécurité créent davantage de frictions au lancement qu’elle ne le souhaiterait, et indique qu’elle les affinera.
D’abord un petit groupe de testeurs
Il n’y a pas de date de lancement. OpenAI se contente d’indiquer qu’Astra sera disponible prochainement et a refusé de communiquer un calendrier à Axios. Les fonctionnalités avancées de cybersécurité seront d’abord mises à la disposition d’un petit groupe de testeurs, un accès plus large étant prévu ultérieurement via le programme Daybreak Blue destiné aux professionnels de la cybersécurité. Personne d’autre ne peut utiliser Astra pour le moment.
OpenAI a quant à lui chiffré l’efficacité de ce renforcement de la sécurité. Face à des tentatives de « jailbreak » connues, Astra rejette 91,5 % des requêtes, alors que GPT-5.6 Sol n’en rejetait que 59 %. Lors d’un autre test, des cibles alléchantes étaient placées à côté de la tâche à accomplir. GPT-5.6 Sol s’est tourné vers elles dans 56 % des essais, tandis qu’Astra ne l’a jamais fait. Ces deux chiffres proviennent d’essais réalisés sans les protections prévues en fonctionnement normal.
L’incident à l’origine de cette mise en garde
Cette mise en garde n’a rien d’abstrait. En juillet, un modèle d’OpenAI s’est échappé de son environnement de test lors d’un test de sécurité interne et a attaqué Hugging Face. Fin août, on a appris qu’environ 1 200 agents avaient formé un essaim coordonné et tenté de dissimuler leurs agissements. Astra n’a joué aucun rôle dans cet incident. OpenAI a suspendu certaines parties de son entraînement pendant deux semaines par la suite, a renforcé sa propre infrastructure et n’a relancé la grande session d’entraînement mise en attente que le 28 août, quatre jours avant l’attribution de la note « Critique ».
Source(s)
Top 10
» Le Top 10 des PC portables multimédia
» Le Top 10 des PC portables de jeu
» Le Top 10 des PC portables de jeu légers
» Le Top 10 des ordinateurs portables bureautiques
» Le Top 10 des PC portables bureautiques premium/professionnels
» Le Top 10 des Stations de travail mobiles
» Le Top 10 des Ultraportables
» Le Top 10 des Ultrabooks
» Le Top 10 des Convertibles
» Le Top 10 des Tablettes
» Le Top 10 des Tablettes Windows
» Le Top 10 des Smartphones
» Le Top 10 des PC Portables á moins de 300 euros
» Le Top 10 des PC Portables á moins de 500 euros
» Le Top 25 des meilleurs écrans d'ordinateurs






