A Anthropic desta vez explicou o que é “destilação ilegal”😛 No mais recente artigo “Relatório de Detecção e Combate ao Abuso de IA”, além de trazer ataques cibernéticos, ações de vigilância, fazendas de bots e fraude, também revela detalhes de destilação ilegal de sete laboratórios de IA na China! Primeiro, vamos excluir a boa intenção de usar destilação para construir modelos de pesos abertos e “igualar a inteligência” para todos: a violação da privacidade por esses “postos de revezamento” é realmente assustadora. Se não for necessário, não abuse 。。。

A destilação em si é uma técnica de treinamento legal: usar um modelo “professor” grande e poderoso para gerar respostas para uma série de entradas; depois, usar essas perguntas e respostas para treinar um modelo “aluno” menor, imitando o professor, alcançando capacidades maiores com menor custo.

A definição do relatório para destilação ilegal é: em escala industrial, de forma discreta, extrair de maneira não autorizada a capacidade de um determinado modelo e copiá-la para outro. Sua característica central é sustentada por fraude — com identidades falsas, cartões clonados/cartões de crédito virtuais, credenciais de login roubadas e chaves de API roubadas para montar milhares e milhares de contas falsas.

Três canais principais:

1. Serviços de proxy / “posto de revezamento”: roteiam solicitações por meio de serviços de proxy, usando identidades falsas, cartões falsos ou cartões clonados, e chaves de API roubadas para registrar em massa milhares de contas, contornando limitações geográficas. O que é roubado geralmente são credenciais de API de empresas ou indivíduos legítimos, causando dano direto aos clientes reais;

2. Comprar registros de conversa de revendedores terceiros
Alguns operadores de serviços de proxy salvam todas as conversas dos usuários com modelos dos EUA sem o conhecimento ou consentimento dos usuários e depois empacotam e vendem para laboratórios (a pipeline de destilação da SenseTime usou esse tipo de registros adquiridos);

3. Encaminhamento silencioso dos pedidos dos próprios usuários(o mais discreto): o laboratório encaminha secretamente as solicitações de seus próprios usuários para o Claude, depois devolve as respostas do Claude como se fossem a saída do seu próprio modelo ao usuário, ao mesmo tempo em que salva essas trocas para treinamento — esse é o método da Moonshot e da DeepSeek! Não dá para não admirar a capacidade desse produto😆

Vender a privacidade dos usuários é a consequência mais grave. DeepSeek, Xiaomi e Moonshot alimentam as conversas dos próprios usuários ao Claude, e os usuários não sabem de nada. Muitas solicitações vêm de serviços de roteamento de modelos de terceiros comuns na Europa e EUA, envolvendo centenas de usuários finais e, ao menos, dezesseis tipos de nomes, e-mails e dados de empresas.