Un premier pour OpenAI : le seuil critique n'est plus exclu
OpenAI a publié le 7 août 2026 un billet officiel sur les évaluations de son modèle Astra, concluant qu'elle ne peut plus exclure que ce dernier atteigne le niveau dit « critique » de son Preparedness Framework. C'est une première : les modèles précédents, dont GPT-5.6-Sol, avaient été évalués au niveau « High », un cran en dessous. Le Preparedness Framework, mis en place en décembre 2023 et mis à jour en 2025, classe les capacités des modèles frontières selon plusieurs paliers, du plus bas au plus élevé, dans des domaines comme la cybersécurité, le biologique ou l'auto-amélioration. Le niveau critique en est le sommet.
Concrètement, ce seuil désigne un modèle capable d'identifier et de développer seul des exploits zero-day fonctionnels dans des systèmes durcis, sans intervention humaine, ou de concevoir et d'exécuter une cyberattaque de bout en bout à partir d'un objectif de haut niveau. En clair : un modèle qui n'aurait besoin d'aucun opérateur humain pour compromettre une infrastructure critique. C'est précisément ce qu'OpenAI décrit dans son billet officiel du 7 août.
Des tests préliminaires, des mesures immédiates
OpenAI prend soin de préciser que les évaluations en cours n'établissent pas définitivement qu'Astra a franchi ce seuil. Les tests montrent des performances élevées, mais restent préliminaires. L'entreprise précise également qu'Astra n'est pas impliqué dans l'incident Hugging Face mentionné dans d'autres contextes.
Malgré cette réserve, la réaction interne est concrète. OpenAI a suspendu les travaux internes non conformes sur Astra, renforcé ses contrôles de sécurité, mis en place une surveillance active et annoncé une coopération avec des agences gouvernementales et des organisations de sécurité. Pour les utilisateurs soucieux de protéger leurs propres actifs numériques, notre guide sécurité crypto par France Cryptos rappelle que les vecteurs d'attaque évoluent vite et que les outils d'IA en font désormais partie.
La portée de cette annonce dépasse le seul cas Astra. En reconnaissant publiquement qu'un modèle commercial pourrait approcher des capacités offensives autonomes, OpenAI ouvre un débat que les régulateurs, notamment en Europe dans le cadre de l'AI Act, ne pourront pas ignorer longtemps. Le marché de prédiction donnait au moment du tweet 17% de probabilité à une restriction gouvernementale d'accès à un grand modèle d'IA aux États-Unis en 2026 : un chiffre modeste, mais qui reflète une prise de conscience réelle du risque systémique que représente ce type de capacité non maîtrisée.












