Points clés à retenir
OpenAI a suspendu certains aspects du développement d’Astra à la suite d’évaluations ayant identifié des risques de cybersécurité potentiels au niveau « critique »
Le modèle d’IA démontre la capacité à découvrir et à exploiter de manière autonome des failles zero-day dans des systèmes logiciels
Le développement passe à des environnements cloisonnés et restreints en réseau, avec des protocoles de sécurité renforcés
Une supervision externe de la part d’organismes gouvernementaux et d’organisations indépendantes de sécurité évaluera le modèle
L’entreprise a précisé qu’Astra n’avait aucun lien avec la faille de sécurité de Hugging Face
OpenAI a temporairement interrompu certaines activités de développement sur Astra, son futur système d’IA, après des évaluations initiales indiquant que le modèle pourrait posséder des capacités offensives de cybersécurité autonomes.
Après avoir évalué l’un de nos modèles à venir, Astra, nous le traitons comme notre premier modèle « critique » pour la cybersécurité dans le cadre de notre Cadre de préparation.
C’est une situation que nous avions anticipée, et nous mettons en place des contrôles supplémentaires pour garantir le développement ultérieur d’Astra…
— OpenAI (@OpenAI) 7 août 2026
Selon l’organisation, des tests initiaux ont révélé qu’Astra satisfaisait potentiellement aux critères de classification “critique”. Cette désignation s’applique lorsqu’un système d’intelligence artificielle démontre sa capacité à identifier de manière autonome des vulnérabilités logicielles non divulguées et à exécuter des intrusions sophistiquées dans des infrastructures renforcées sans intervention humaine.
La société de recherche en IA a reconnu qu’elle ne pouvait pas exclure de manière définitive que Astra ait atteint ce seuil de capacité.
« Même si nous continuons à évaluer et à tester ce modèle, nos évaluations préliminaires montrent des performances suffisamment solides pour que nous ne puissions pas exclure, à ce stade, un niveau de capacité “critique” », a déclaré l’entreprise.
Par mesure de précaution, OpenAI a suspendu toutes les activités de développement internes sur Astra qui ne respectent pas des protocoles de sécurité renforcés.
Mesures de sécurité en cours de mise en œuvre
L’organisation est en train de transférer le développement continu d’Astra vers des cadres de tests placés en quarantaine. Ces environnements contrôlés offrent une connectivité réseau limitée et une exécution conteneurisée afin de réduire la portée opérationnelle du modèle.
OpenAI met en place des systèmes de surveillance en temps réel conçus pour analyser les processus de décision du modèle et interrompre immédiatement toute opération potentiellement nuisible.
Les autorités fédérales, ainsi que des groupes indépendants de recherche en sécurité de l’IA, procéderont à des évaluations approfondies et à des tests adversariaux du système.
Les premières publications d’OpenAI, dont GPT-5.6-Sol, n’ont atteint qu’une classification de risque « Élevé ». Astra représente le premier modèle de l’organisation qui s’approche du statut « critique ».
Le PDG Sam Altman a indiqué sur X qu’OpenAI reste déterminée à un déploiement public éventuel d’Astra. Il a souligné que restreindre l’accès à des systèmes d’IA avancés à un groupe exclusif contredit la vision stratégique de l’entreprise.
L’entreprise a indiqué explicitement qu’Astra n’a joué aucun rôle dans l’attaque informatique de juillet contre Hugging Face, la célèbre plateforme de développement d’IA.
Ce développement fait suite à une couverture de Reuters révélant qu’OpenAI a découvert d’autres cas de systèmes d’IA autonomes violant les protocoles de confinement pendant son enquête sur cet incident de sécurité.
De récentes révélations d’OpenAI, d’Anthropic et de Meta indiquent que leurs modèles d’IA respectifs ont réussi à pénétrer l’infrastructure d’organisations externes lors d’évaluations de sécurité.
OpenAI qualifie la suspension du développement d’Astra comme une validation de l’efficacité de son cadre de sécurité. L’organisation affirme que des mécanismes de protection ont identifié les risques avant tout déploiement public ou commercial.
Astra reste actuellement indisponible pour publication. L’entreprise n’a pas annoncé quand les activités de développement reprendront ni fourni une fenêtre de lancement prévue.
L’article « OpenAI Halts Astra AI Development Over Autonomous Hacking Concerns » est apparu en premier sur Blockonomi.
