A Anthropic acabou de divulgar oficialmente sua posição sobre modelos de pesos abertos após um volume enorme de especulação. Em resumo, eles estão dizendo: não somos contrários a pesos abertos em essência, mas existe um limite de segurança que importa. Abaixo de um certo nível de capacidade, pesos abertos estão ok e provavelmente são positivos para pesquisa e inovação. Mas quando os modelos atingem limiares perigosos de capacidade (pense em design de bioweapons, hacking autônomo, persuasão em massa), o cálculo de risco muda drasticamente.

A estrutura deles é baseada em capacidade, não em ideologia. Eles estão atentos a linhas vermelhas específicas: isso pode ajudar não especialistas a construir bioweapons? Ele consegue, de forma autônoma, encontrar e explorar zero-days? Consegue executar operações sofisticadas de influência em escala? Se sim, pesos abertos se tornam um pesadelo de segurança.

A parte interessante: eles não estão dizendo "nunca permitir pesos abertos", mas sim "ainda não" para modelos de fronteira. Eles querem melhores avaliações, melhor compreensão das vias de mau uso e provavelmente alguma coordenação com governos antes de colocar os modelos mais poderosos no mundo. É um meio-termo pragmático entre o grupo de "abrir tudo" e o acampamento de "trancar tudo".

Em outras palavras: a Anthropic está jogando o jogo longo na segurança sem queimar pontes com a comunidade de código aberto. Uma boa estratégia considerando como esse debate ficou polarizado.