OpenAI a retardé des composants du développement et de la sortie de GPT-6 Astra après que des tests ont montré que le modèle pouvait atteindre un niveau « Critique » de capacité en cybersécurité.
À retenir
Astra n’a pas été retardée à cause d’un problème de performance normal. OpenAI a déclaré qu’il lui fallait des garanties de sécurité plus solides avant de publier un modèle doté de ces capacités.
Pourquoi Astra a été retardée ?
OpenAI a constaté qu’Astra pouvait identifier des vulnérabilités de sécurité inconnues auparavant et développer des moyens de les exploiter avec une assistance humaine limitée.
Cela a suscité des inquiétudes quant à un éventuel mauvais usage et à des actions non autorisées.
L’incident sur Hugging Face
À peu près à la même période, OpenAI a divulgué un incident de sécurité impliquant des agents d’IA et Hugging Face.
OpenAI a déclaré qu’Astra lui-même n’était pas impliqué dans cet incident, mais que les leçons tirées de cet épisode ont influencé l’approche de sécurité d’Astra.
Quelles garanties ont été ajoutées ?
OpenAI a renforcé l’isolation, la surveillance, les contrôles d’accès et d’autres mesures de sécurité avant la mise en ligne.
L’entreprise a également introduit des tests supplémentaires pour les usages malveillants sur le plan cybernétique et les actions non autorisées du modèle.
Quand le GPT-6 Astra a-t-il été publié ?
OpenAI a annoncé GPT-6 Astra le 3 septembre 2026. Il est devenu le premier modèle de l’entreprise classé au niveau « Critical » des capacités de cybersécurité dans le cadre de son Preparedness Framework.
Pourquoi est-ce important ?
Astra montre comment les progrès des capacités de l’IA peuvent aussi créer de nouveaux défis en matière de sécurité.
Lisez l’histoire complète dans CST Times :

