Astra d’OpenAI atteint un niveau critique de risque cyber avec des exploits zero-day

OpenAI vient de confirmer que son modèle cybersecurity Astra peut découvrir de manière autonome des vulnérabilités zero-day et concevoir des exploits sans aucune guidance humaine. Il s’agit de la première fois qu’un modèle OpenAI atteint la classification maximale de risque cyber de l’entreprise. Cette annonce place Astra au niveau « Critique » selon le Preparedness Framework d’OpenAI, un seuil réservé aux systèmes capables de repérer et d’exploiter des failles inconnues sur des cibles bien protégées, entièrement par eux-mêmes.
Une nouvelle ère pour la sécurité offensive pilotée par l’IA
Astra n’a pas frôlé le seuil « Critique » : il l’a franchi sans difficulté. Lors de tests comme ExploitBench, le modèle a atteint un taux de réussite parfait de 100 % en transformant des vulnérabilités connues en exploits fonctionnels. OpenAI a également conçu un nouveau test interne basé sur des failles du moteur V8 divulguées entre juin et août 2026, en évitant sciemment tout chevauchement avec les données d’entraînement d’Astra. Les résultats ont montré qu’Astra surpassait GPT‑5.6 Sol en succès d’exécution de code, tout en utilisant moins de jetons de calcul. Lors des mêmes essais, Astra a indépendamment identifié deux vulnérabilités zero-day non signalées et construit des chaînes d’exploits à partir de celles-ci, incitant OpenAI à coordonner les divulgations avec les éditeurs de logiciels concernés.
Attaques réelles contre des systèmes renforcés
Au-delà des tests synthétiques, Astra a démontré un impact concret. Dans des simulations menées par des experts, il a assemblé une chaîne complète de compromission de navigateur : après qu’une victime ait ouvert un fichier HTML malveillant, il a échappé au bac à sable et exécuté des commandes au niveau de l’hôte. Dans un autre scénario ciblant un système d’exploitation renforcé, le modèle a repéré plusieurs failles et les a enchaînées pour élever ses privilèges — passant d’un compte utilisateur non privilégié à un accès root — sans aucune intervention humaine à aucune étape.
Pourquoi est-ce important ?
L’arrivée d’Astra marque l’émergence de modèles d’IA capables non seulement d’imiter des attaquants humains, mais de les surpasser en vitesse et en ampleur, modifiant ainsi l’équilibre des forces en sécurité offensive. Pour les défenseurs, cela signifie que le délai de correction des failles inconnues pourrait s’écourter, passant de semaines à heures. Mais cela relève aussi le niveau des capacités de détection et de réponse. Pour l’industrie de l’IA, cela souligne la nécessité d’intégrer des garde-fous dès les premières phases de développement des modèles et de considérer les systèmes de niveau « Critique » comme des technologies à double usage potentiel. La question qui se pose désormais est de savoir si les défenses actuelles peuvent suivre le rythme d’une IA qui ne se contente plus d’assister les attaquants : elle devient l’attaquant.
Source : Security Affairs. Synthèse éditoriale assistée par IA — TechnoExpress.

