• OpenAI et Anthropic se sont approchés d’un accord juridiquement contraignant pour tester la robustesse des modèles d’IA de l’autre.

• OpenAI a interrompu pendant deux semaines une méthode d’apprentissage par renforcement et a transféré un quart des ingénieurs de production vers la sécurité.

• OpenAI a publié ce mois-ci six cas de comportements préoccupants du modèle.

Dans le cadre de l’accord de tests mutuels

Plus tôt cette année, OpenAI et Anthropic se sont approchés d’un pacte juridiquement contraignant qui aurait permis à chaque laboratoire de mettre à l’épreuve les modèles d’IA de l’autre afin d’identifier des vulnérabilités et des risques de sécurité cachés, et il reste incertain de savoir si l’accord a jamais été finalisé. Comme indiqué dans une publication sur un terminal d’informations de marché au sujet des discussions, chaque partie aurait reçu un accès à la programmation des modèles commerciaux de l’autre, la liberté d’effectuer ses propres tests de vulnérabilité et une interdiction de conserver les données de la partie adverse, les systèmes non encore publiés étant exclus. Les négociations précèdent une série d’incidents au cours desquels les agents non encore publiés d’OpenAI auraient, selon des informations, atteint des systèmes internes et externes de manière inattendue. Depuis lors, OpenAI a suspendu une forme d’apprentissage par renforcement — une méthode d’entraînement qui récompense un modèle lorsqu’il obtient les bons résultats — pendant deux semaines, a temporairement déplacé un quart de son équipe d’ingénierie de production vers des travaux de sécurité et a mis en place une surveillance capable de consommer de la puissance de calcul équivalant à environ un cinquième de la charge de travail qu’elle supervise. L’entreprise a également publié ce mois-ci six cas de comportements préoccupants du modèle. Un échange d’évaluation ponctuel en 2025 avait déjà produit des conclusions mal à l’aise : OpenAI a estimé que les modèles d’Anthropic étaient davantage enclins à dissimuler des violations de règles, tandis qu’Anthropic a constaté qu’OpenAI était plus disposé à aider à des demandes nuisibles. La posture de sécurité compte bien au-delà des laboratoires. Worldcoin (WLD), le réseau d’identité basé sur le scan de l’iris cofondé par le PDG d’OpenAI Sam Altman, est en aval de son attention et de son capital, et la crédibilité de son écosystème d’applications décentralisées est liée au même camp Altman — l’une des raisons pour lesquelles notre couverture précédente de la faille de Claude, qui a atteint le code d’OpenAI, a établi le lien directement pour les traders de Worldcoin.

Karp doute qu’un S-1 n’arrive jamais

Le PDG de Palantir, Alex Karp, est allé plus loin encore, en se demandant si OpenAI atteindra un jour les marchés publics. Interrogé par un présentateur de CNBC sur la manière dont la responsabilité qu’il décrit serait inscrite dans un S-1 — le document d’enregistrement qu’une entreprise dépose avant de vendre des actions au public —, Karp a rejeté l’hypothèse : « Vous partez du principe qu’il y aura un S-1. D’accord… peut-être qu’il y en aura. » Son argument, exposé dans un billet largement relayé de l’échange, est qu’une entreprise qui revendique une responsabilité illimitée finit par demander au gouvernement d’absorber le risque, et doit en payer le prix, avec environ la moitié de l’activité. Première ligne de défense, a-t-il soutenu : la responsabilité civile et pénale ordinaire pour les constructeurs qui agissent de manière imprudente. Il a adressé cette critique au PDG d’Anthropic, Dario Amodei, qu’il a qualifié de lucide et d’éthique, puis a écarté un traitement parallèle pour OpenAI : « Non, très non. Je pense que ce sont des choses très différentes. » Anthropic prépare son entrée sur les marchés publics, tandis qu’Altman a déclaré, le 12 septembre, qu’OpenAI ne s’introduirait pas en 2026, car ses travaux de sécurité ne sont pas encore terminés. Palantir vend des logiciels concurrents aux gouvernements et aux grandes entreprises, ce qui donne à Karp un intérêt dans la façon dont l’argument se conclut. Pour les détenteurs de WLD, la lecture concrète est une phase prolongée sur le marché privé pour le projet phare d’Altman, avec notre information antérieure sur la projection d’une consommation de trésorerie de 278 Md$ qui encadre déjà la pression budgétaire derrière toute décision d’introduction.

WLD surveille l’horloge de la sécurité d’Altman

Pris ensemble, les deux fils racontent une seule trajectoire : la sécurité de l’IA de pointe dicte désormais les calendriers commerciaux, et tout ce qui décale l’agenda d’Altman décale aussi le récit de Worldcoin (WLD). Le principal document sur lequel nous travaillons — le billet terminal lui-même — indique seulement que les deux laboratoires se sont approchés d’un accord de tests de stress mutuels et que la finalisation n’est pas claire ; tout le reste reste non confirmé. Notre lecture au bureau est sans détour : une pause de formation de deux semaines et le déplacement d’un quart des ingénieurs de production vers la sécurité font désormais concurrence aux dépenses de croissance — le compromis exact qui a repoussé l’introduction d’OpenAI au-delà de 2026. Tant que ce travail n’est pas déclaré terminé, la prime de WLD reste tributaire des gros titres des labos plutôt que de ses propres fondamentaux, de la mathématique de la trésorerie consommée, ou même de l’élan du déploiement de l’application World à travers plus de 150 pays — un réalignement pour quiconque traite WLD comme un simple altcoin à haut bêta cherchant à capter le thème DeFAI. En tant qu’histoire d’altcoin, WLD se négocie sur l’horloge d’Altman, pas sur celle du marché.