As campanhas de destilação contra os modelos Claude da Anthropic cresceram a ponto de somar centenas de milhões. Em um relatório divulgado na quinta-feira, a Anthropic disse que observou cerca de 199 milhões de interações ligadas a ataques não autorizados de destilação, distribuídas em cinco campanhas separadas que ela atribui a laboratórios de IA baseados na China, com o maior esforço individual associado à família de modelos Qwen, da Alibaba.

O que a Anthropic diz que as campanhas parecem

A destilação é uma técnica padrão de machine learning: um modelo menor é treinado com as saídas de um modelo maior para transferir capacidade de raciocínio. O ponto de atrito é o consentimento. A Anthropic diz que o encadeamento interno de raciocínio de seus modelos não é exposto aos usuários e que as campanhas encontraram maneiras de extrair esses registros mesmo assim.

Uma técnica documentada enquadrava uma pergunta como uma tarefa de tradução, pedindo ao modelo que renderizasse a sua memória de trabalho anterior em japonês. A empresa caracterizou o padrão mais amplo como uma tentativa de "capturar algumas das capacidades mais valiosas da Claude, incluindo capacidades agenticas e uso de ferramentas, programação e análise de dados, e raciocínio lógico."

A campanha da Alibaba ofusca divulgações anteriores

A Anthropic descreve o esforço atribuído à Alibaba como a maior destilação em larga escala que ela já documentou. Entre maio e julho de 2026, a empresa observou 151 milhões de interações, com pico de perto de três milhões por dia, distribuídas por cerca de 3.500 contas.

O que uniu essas contas, de acordo com a Anthropic, foi um único prompt fixo de extração. Essa assinatura compartilhada é a razão pela qual a empresa atribui a atividade a um esforço orquestrado para gerar material de treinamento para a família de modelos Qwen, em vez de milhares de usuários independentes.

A escala se destaca em comparação com divulgações anteriores da própria Anthropic. A empresa falou publicamente pela primeira vez sobre ataques de destilação em fevereiro, citando laboratórios específicos na época. A OpenAI relatou atividade semelhante, que atribuiu à DeepSeek. O novo relatório da Anthropic descreve campanhas que ela caracteriza como tanto maiores quanto mais agressivas do que essa onda anterior.

Moonshot AI e a alegação de roteamento militar

A segunda campanha que a Anthropic detalha é atribuída à Moonshot AI, fabricante da assistente Kimi. De acordo com o relatório, os pedidos pareciam ser roteados diretamente a partir do exército chinês. A Anthropic cita um exemplo em que a Claude foi solicitada a avaliar um acervo de vídeos de vigilância em circuito fechado para determinar se um sujeito estava "se comportando de forma anormal".

Ao longo de uma janela de dez dias, a Anthropic diz que quase 300.000 pedidos fluíram por uma rede de cerca de 5.000 contas, com foco principalmente no modelo Opus da empresa.

O que a divulgação significa para a política de IA e a concorrência

As descobertas da Anthropic chegam no meio de um argumento regulatório mais amplo sobre quanto do valor de um modelo de fronteira está em seus pesos versus em sua implantação. Debates sobre controle de exportações nos EUA têm tratado cada vez mais chips avançados e conhecimento do modelo como sensíveis do ponto de vista estratégico, e as descobertas sobre destilação dão aos reguladores uma categoria concreta de comportamento para apontar.

Para compradores empresariais, a questão prática é diferente: se as salvaguardas que a Anthropic descreve — blocos de pensamento resumido em vez de rastros brutos — se sustentam diante de métodos de extração cada vez mais criativos. O relatório da empresa sugere que atacantes iteram mais rápido do que as defesas.

O que observar a seguir tem menos a ver com a Claude e mais com a resposta da indústria. Ferramentas de detecção, monitoramento de padrões de uso e possivelmente limites contratuais ou legislativos para a colheita de modelos agora são um tema em discussão. Se os fornecedores coordenam para aplicar a fiscalização, ou se deixam uns aos outros defenderem seus próprios “moats” separados, vai moldar tanto o ritmo de difusão de capacidades quanto a confiança que compradores depositam nos provedores de IA de fronteira daqui para frente.

Publicado originalmente no CoinPulseHQ: https://coinpulsehq.com/anthropic-distillation-alibaba-moonshot-deepseek/