Deux laboratoires qui se livrent une lutte acharnée ont failli signer un accord visant à se saboter mutuellement.

D’après des informations relayées par les médias, OpenAI et Anthropic se sont approchées, plus tôt cette année, d’un accord contraignant permettant à chacune des deux parties de tester les modèles de l’autre, à la recherche de failles et de risques de sécurité dissimulés. Selon les modalités révélées, les deux parties pouvaient obtenir un accès au code des modèles commerciaux de l’autre, effectuer leurs propres tests de vulnérabilités, et interdire toute conservation des données de l’adversaire.

Le périmètre est très clairement défini : les systèmes non encore publiés n’en font pas partie. Autrement dit, ce qui peut être vérifié correspond à ce qui a déjà été vendu, tandis que les éléments non encore sortis restent en interne. Ce dispositif confie une partie du pouvoir de vérification aux pairs, tout en transformant le jugement des pairs en une forme de supervision externe.

On ignore si cet accord a finalement été signé. Confier les contrôles les plus sensibles à un concurrent ne relève pas de la bonne volonté : il faut que les deux parties soient convaincues que l’autre respectera les règles. Deux entreprises qui se voient comme des adversaires : la ressource la plus rare n’a jamais été autre que la confiance. Et chacune des deux s’applique à déceler les défauts de l’autre tout en refusant de laisser l’autre voir ses propres cartes.

La même semaine, un dirigeant d’entreprise a publiquement remis en question la capacité de l’une des sociétés à atteindre son introduction en Bourse, tout en excluant directement l’autre. La confiance dans l’industrie, semble-t-il, n’est invoquée que lorsqu’il s’agit de prouver quelque chose.

Le plafond de la coopération en matière de sécurité figure généralement dans les quelques lignes du périmètre de divulgation.

#人工智能 # Sécurité