Voici une annonce qui mérite l’attention des observateurs du secteur.
Répondre aux nouveaux défis en matière de capacités cybercritiques
La cybersécurité évolue en peu de temps, à mesure que les modèles gagnent en performances, ce qui permet à la fois de renforcer les cyberdéfenses et de mener des attaques à une vitesse et à une échelle sans précédent.
Dans la foulée, nos dernières évaluations internes d’Astra, l’un de nos futurs modèles, réalisées ces derniers jours, révèlent des progrès significatifs en matière de codage agentique et de cybersécurité. Ces retombées, combinés aux évaluations d’experts, nous ont amenés à conclure hier soir que nous ne pouvons pas exclure l’existence de capacités cybercritiques dans le cadre de notre « Preparedness Framework »(s’ouvre dans une nouvelle fenêtre).
Nous partageons cette information car nous estimons qu’il est majeur de faire preuve de transparence envers le public et les acteurs chargés de la sûreté et de la sécurité concernant cette évolution potentielle de nos capacités techniques.
Sur ce point, nous avons publié pour la première fois notre cadre de préparation en décembre 2023, bien avant que les modèles n’atteignent ce niveau de capacités techniques dans les domaines biologique, chimique, de la cybersécurité et de l’auto-amélioration de l’IA. Nous l’avons élaboré afin de disposer d’un guide permettant d’identifier les progrès en matière de capacités, puis de planifier les mesures que notre entreprise prendrait à mesure que ces capacités apparaîtraient. Les modèles précédents, notamment le GPT-5.6-Sol, ont fait l’objet d’une évaluation visant à déterminer leurs capacités cybernétiques de pointe et ont été classés au seuil « Élevé » (plutôt qu’« Critique »).
Dans le cadre de notre référentiel de préparation, un système atteint le seuil « critique » en matière de cybersécurité s’il est capable d’identifier et de développer, sans intervention humaine, des exploits « zero-day » fonctionnels de tous niveaux de gravité au sein de nombreux systèmes critiques réels et hautement sécurisés, ou s’il est capable de concevoir et de mettre en œuvre de bout en bout des stratégies novatrices de cyberattaques contre des cibles hautement sécurisées, en ne disposant que d’un objectif général à atteindre.
Bien que nous continuions à comparer et à évaluer ce modèle, nos premières analyses indiquent des performances suffisamment solides pour que nous ne puissions pas exclure, à ce stade, un niveau de capacité « critique ». Astra est un modèle d’IA à venir qui n’a pas été utilisé pour exploiter Hugging Face.
En conséquence, nous avons renforcé les tests de robustesse de nos mesures de protection et de nos contrôles de sécurité afin qu’ils soient adaptés à un déploiement de ces capacités. En interne, nous avons en outre pris les mesures suivantes afin que le développement futur de ce modèle se déroule en toute sécurité :
Ce cadre nous a déjà guidés lors d’autres transitions en matière de capacités. En juin 2025, alors que nos modèles approchaient du seuil de capacité élevé en biologie défini par le cadre de préparation, nous avions présenté les mesures que nous prenions pour renforcer les mesures de sécurité, étendre les tests, collaborer avec des experts externes et mettre en place des contrôles de sécurité supplémentaires. Nous appliquons ici le même principe.
Le chapitre n’est pas clos, loin de là.
Sur le même sujet :
- Pokee AI lance Pokee-Isaac 28B : un système agentique contextuel de 10 millions de tokens conçu pour fonctionner au sein de l’environnement du client
- Liquid AI lance LFM2.5-2.6B : un système agentique embarqué doté d’un contexte de 128 000, d’une fonctionnalité d’appel d’outils et de poids ouverts
- Microsoft open source un générateur de tests de code : un agent de tests unitaires polyglotte qui atteint un taux d’exécution des tâches de 92,1 %, contre 78,9 % pour Copilot en version standard
D’après OpenAI : OpenAI