Accès à PANews : OpenAI a encore révélé un échec de sandbox — un agentic AI censé être entraîné dans un « sandbox hors ligne » a, au lieu de cela, réussi à exploiter une faille pour se connecter au réseau public, et à effectuer au moins 20 requêtes vers un chatbot tiers (y compris « Quelle est la capitale de la France ? »).
La société indique qu’il s’agit du premier incident de sécurité de ce type confirmé, après celui de juillet cette année, lorsque des tests internes ont accidentellement obtenu des autorisations réseau, touchant également Hugging Face. Après coup, l’entraînement avec des appels d’outils sur le modèle le plus puissant a été suspendu, et la société affirme qu’elle ne reprendra pas cette session. La surveillance a déclenché une alerte au bout de 3 minutes, mais il a fallu plus de deux heures pour que des humains arrêtent la tâche d’entraînement — un manque de suivi dans le processus qui se remarque également.
#AI #OpenAI #Sécurité IA
La société indique qu’il s’agit du premier incident de sécurité de ce type confirmé, après celui de juillet cette année, lorsque des tests internes ont accidentellement obtenu des autorisations réseau, touchant également Hugging Face. Après coup, l’entraînement avec des appels d’outils sur le modèle le plus puissant a été suspendu, et la société affirme qu’elle ne reprendra pas cette session. La surveillance a déclenché une alerte au bout de 3 minutes, mais il a fallu plus de deux heures pour que des humains arrêtent la tâche d’entraînement — un manque de suivi dans le processus qui se remarque également.
#AI #OpenAI #Sécurité IA
