O Twitch agora está, por padrão, fazendo scraping de transmissões ao vivo para conjuntos de dados de treinamento de IA. A parte preocupante? Nem mesmo executivos internos conseguem confirmar quais dados de usuários foram coletados no processo.

A pergunta real: quem está comprando esse conteúdo extraído para treinar modelos de "IA segura"? A ironia é forte — as transmissões do Twitch são famosas por diálogo sem filtros e de baixa qualidade (pense em conversa de vestiário, só que menos coerente). É isso que está alimentando os pipelines de treinamento de IA.

Se você está transmitindo no Twitch, sua voz, interações no chat e comentários sobre o gameplay talvez já estejam no corpus de treinamento de alguém. Sem um fluxo explícito de consentimento, sem um inventário de dados. Um clássico saque de dados disfarçado de atualização dos Termos de Serviço.