OpenAI suspend temporairement les travaux sur Astra. Son futur modèle d’intelligence artificielle auraient atteint un niveau suffisamment élevé en cybersécurité pour inquiéter ses équipes. Les évaluations internes suggèrent que ce système pourrait automatiser des opérations cyber complexes, jusqu’à potentiellement exploiter certaines vulnérabilités sans intervention humaine.
Sommaire :
Astra franchit un seuil de cybersécurité particulièrement sensible selon OpenAI
OpenAI explique que ses dernières évaluations ont révélé des progrès importants d’Astra en codage agentique et en cybersécurité. Le problème ne réside donc pas uniquement dans sa capacité à générer du code. C’est son aptitude à enchaîner plusieurs actions pour atteindre un objectif complexe avec une autonomie accrue qui pose question.
Selon le Preparedness Framework d’OpenAI, un modèle atteint le niveau « Critical » en cybersécurité. Et ceci, lorsqu’il peut identifier et développer des exploits zero-day fonctionnels sur de nombreux systèmes critiques fortement protégés, sans assistance humaine. Il peut également entrer dans cette catégorie s’il est capable de concevoir puis d’exécuter une stratégie complète de cyberattaque. Tout cela à partir d’un simple objectif général.
Une vulnérabilité zero-day correspond à une faille inconnue ou non corrigée au moment où elle est exploitée. Pour un système agentique, la combinaison entre raisonnement, génération de code, utilisation d’outils et exécution autonome peut donc considérablement élargir les possibilités d’attaque.
Cette situation intervient alors que les capacités cyber des modèles progressent rapidement. Les générations récentes d’OpenAI se placent déjà dans la catégorie « High » dans ce domaine. Même si elles n’atteignent pas encore le niveau « Critical ». GPT-5.6, par exemple, est évalué comme High en cybersécurité. De son côté, son modèle Sol atteint 96,7 % sur certaines évaluations CTF internes.
VOIR AUSSI : OpenAI préparerait une enceinte IA portable qui peut aussi bouger
Une suspension destinée à renforcer les garde-fous
OpenAI précise qu’Astra n’est pas impliqué dans l’incident ayant récemment touché Hugging Face en Juillet. La société entend néanmoins tirer les conséquences de cette période de tests et renforcer les contrôles appliqués à ses systèmes agentiques.
Les activités internes liées à Astra se retrouvent donc suspendues jusqu’à ce que les exigences de sécurité soient satisfaites. OpenAI prévoit également de travailler avec des agences gouvernementales et des organisations spécialisées dans la sécurité de l’IA afin de tester ses capacités.
Cette décision illustre surtout un changement d’échelle. Lorsque les modèles deviennent capables d’exécuter des chaînes d’actions complexes, leur évaluation ne peut plus se limiter à la qualité de leurs réponses. Les mécanismes de surveillance, de contrôle des outils et d’interruption deviennent eux aussi essentiels avant toute mise à disposition.
IdealoGeek est un média indépendant. Soutiens-nous en nous ajoutant à tes favoris sur Google Actualités :





