Les campagnes de distillation contre les modèles Claude d’Anthropic ont pris une ampleur telle qu’on compte désormais en centaines de millions. Dans un rapport publié jeudi, Anthropic a déclaré avoir observé environ 199 millions d’échanges liés à des attaques de distillation non autorisées, répartis sur cinq campagnes distinctes qu’elle attribue à des laboratoires d’IA basés en Chine, la plus grande initiative étant associée à la famille de modèles Qwen d’Alibaba.

Ce qu’Anthropic dit que les campagnes ressemblent à

La distillation est une technique d’apprentissage automatique standard : un modèle plus petit est entraîné à partir des sorties d’un modèle plus grand afin de transférer des capacités de raisonnement. Le point de friction, c’est le consentement. Anthropic affirme que la chaîne de pensée interne de ses modèles n’est pas exposée aux utilisateurs, et que des campagnes ont néanmoins trouvé des moyens d’en extraire ces traces.

Une technique documentée a présenté une requête comme une tâche de traduction, en demandant au modèle de restituer sa mémoire de travail antérieure en japonais. La société a caractérisé le schéma plus large comme une tentative de « capter certaines des capacités les plus précieuses de Claude, notamment des capacités agentiques et l’usage d’outils, le codage et l’analyse de données, ainsi que le raisonnement logique ».

La campagne d’Alibaba éclipsent les divulgations antérieures

Anthropic décrit l’effort attribué à Alibaba comme la plus grande distillation « en gros » qu’elle ait jamais documentée. Entre mai et juillet 2026, la société a observé 151 millions d’échanges, avec un pic proche de trois millions par jour, répartis sur environ 3 500 comptes.

Ce qui liait ces comptes, selon Anthropic, était une seule invite d’extraction fixe. Cette signature partagée est la raison pour laquelle la société attribue l’activité à un seul effort orchestré visant à générer du matériel d’entraînement pour la famille de modèles Qwen, plutôt qu’à des milliers d’utilisateurs indépendants.

L’ampleur se démarque face aux divulgations antérieures d’Anthropic. La société a d’abord évoqué publiquement des attaques de distillation en février, en citant des laboratoires précis à l’époque. OpenAI a également fait état d’une activité similaire, qu’elle avait attribuée à DeepSeek. Le nouveau rapport d’Anthropic décrit des campagnes qu’il juge à la fois plus importantes et plus agressives que cette vague précédente.

Moonshot AI et l’allégation de routage militaire

La deuxième campagne détaillée par Anthropic est attribuée à Moonshot AI, fabricant de l’assistant Kimi. D’après le rapport, les requêtes semblaient être routées directement depuis l’armée chinoise. Anthropic cite un exemple où l’on a demandé à Claude d’évaluer un lot de vidéos de surveillance en circuit fermé afin de déterminer si un sujet était « en train de se comporter de manière anormale ».

Sur une période de dix jours, Anthropic indique que près de 300 000 requêtes ont transité par un réseau d’environ 5 000 comptes, ciblant principalement le modèle Opus de la société.

Ce que cette divulgation signifie pour la politique en matière d’IA et la concurrence

Les conclusions d’Anthropic se situent au cœur d’un argument réglementaire plus large sur la part de la valeur d’un modèle de pointe qui réside dans ses poids, plutôt que dans son déploiement. Les débats américains sur le contrôle des exportations traitent de plus en plus les puces avancées et le savoir-faire du modèle comme des éléments stratégiquement sensibles, et les résultats sur la distillation donnent aux régulateurs une catégorie concrète de comportement à surveiller.

Pour les acheteurs en entreprise, la question pratique est différente : les garde-fous décrits par Anthropic — des blocs de raisonnement résumés plutôt que des traces brutes — résistent-ils à des méthodes d’extraction de plus en plus créatives. Le rapport de la société suggère que les attaquants itèrent plus vite que les défenses.

Ce qu’il faut surveiller ensuite concerne moins Claude en particulier que la réponse du secteur. Les outils de détection, le suivi des modèles d’utilisation et, éventuellement, des limites contractuelles ou législatives sur la collecte de modèles font désormais l’objet de discussions actives. Que les fournisseurs coordonnent l’application des règles, ou qu’ils laissent chacun l’autre se défendre de manière autonome pour protéger ses propres « douves », déterminera à la fois la vitesse de diffusion des capacités et la confiance que les acheteurs placeront, à l’avenir, dans les fournisseurs d’IA de pointe.

Publié à l’origine sur CoinPulseHQ : https://coinpulsehq.com/anthropic-distillation-alibaba-moonshot-deepseek/