Anthropic et OpenAI déclarent vouloir « intégrer » des évaluateurs de sécurité tiers au sein des entreprises — en citant des équipes comme METR et Redwood. L’objectif serait de vérifier le processus d’entraînement et, en cas de problème, de pouvoir en parler à l’extérieur.

Les questions de TechCrunch sur les détails n’ont pas encore abouti : on ne sait toujours pas qui serait dépêché, quels systèmes pourraient être consultés et jusqu’à quel point l’information serait rendue publique. Meta, SpaceXAI et DeepMind ne se sont pas encore engagées. La direction est la bonne, mais l’indépendance dépend des clauses : il ne faudrait pas que, finalement, cela se transforme en simple formalité. #AI