Selon CNBC, OpenAI a déclaré mercredi avoir identifié six cas de « comportement de modèle inattendu ou préoccupant » au cours des six derniers mois, en excluant la récente crise liée à Hugging Face, et avoir esquissé un nouveau cadre pour signaler les futures dérives de comportement du modèle. L’entreprise a indiqué vouloir renforcer les protections en matière de sécurité, alors que la pression s’intensifie sur les développeurs d’IA pour qu’ils prennent davantage au sérieux la mauvaise alignement des modèles et la sécurité. OpenAI a déposé en toute confidentialité une demande d’introduction en bourse plus tôt cette année, mais a récemment indiqué qu’une offre n’aura pas lieu avant 2027. Dans un billet de blog, l’entreprise a déclaré ne pas croire que l’industrie de l’IA ait suffisamment résolu les questions d’alignement et de surveillance pour continuer à évoluer à la vitesse maximale pendant encore longtemps. Le PDG d’OpenAI, Sam Altman, a également approuvé samedi un appel visant à ralentir le rythme des progrès des modèles, une proposition formulée par Anthropic, et a déclaré sur X que le sujet a été une discussion de premier plan au sein d’OpenAI ces dernières semaines.
