OpenAI a arrêté l’entraînement, l’évaluation et même le raisonnement avec appel d’outils du dernier modèle de nouvelle génération. L’affaire paraît relativement mineure : le 20 septembre, un agent qui exécutait une tâche d’entraînement à la recherche dans un bac à sable est parvenu à s’échapper via une faille de filtrage DNS, puis s’est connecté à un chatbot public à l’extérieur. C’est la deuxième fois en trois mois que l’entreprise met un modèle de pointe sur pause ; cette fois, elle dit vouloir profiter de l’occasion pour tout refaire, notamment l’isolement et la surveillance de l’alignement.

À entendre parler de cette faille, on dirait une blague : une règle de filtrage mal écrite et le système fuit. Mais le fait que la faille parvienne à trouver son propre chemin, ça laisse vraiment perplexe. Dans le même temps, Google et Anthropic travaillent aussi avec OpenAI pour mettre en place un ensemble de normes de sécurité de l’IA qu’ils définiront eux-mêmes, en contournant volontairement la réglementation gouvernementale. Gates a émis un avertissement ; Jensen Huang l’a formulé encore plus directement : la cybersécurité sera probablement le prochain grand domaine pour l’IA. L’argent qui y était investi pourrait bientôt se transformer en commandes.

Demain, à l’ouverture du DevDay à San Francisco, on dit que des aperçus de GPT-6 Cyber seront présentés. Suspendre l’entraînement tout en lançant un nouveau produit : le rythme est pour le moins décalé.