Dois laboratórios em disputa, a ponto de assinarem um acordo para se derrubarem mutuamente por pouco.

Segundo relatos da imprensa, a OpenAI e a Anthropic chegaram perto, no início deste ano, de fechar um acordo vinculante que permitiria a cada uma testar os modelos da outra, em busca de falhas e riscos de segurança implícitos. Pelos termos divulgados, ambas poderiam obter acesso programático aos modelos comerciais da outra, realizar testes de vulnerabilidades por conta própria e seriam proibidas de reter dados da outra parte.

O escopo foi definido com muita clareza: sistemas ainda não lançados não entram. Em outras palavras, o que pode ser verificado é o que já foi vendido; o que ainda não foi colocado no mercado fica “dentro de casa”. Essa estrutura transfere parte do poder de validação para pares e transforma o julgamento desses pares em uma espécie de supervisão externa.

Não está claro, porém, se esse acordo acabou ou não sendo assinado. Entregar a checagem mais sensível a um concorrente exige mais do que boa vontade: exige que as duas partes acreditem que a outra vai cumprir as regras. Para duas empresas que são concorrentes entre si, o recurso mais escasso sempre foi a confiança. E as duas, ao mesmo tempo, estão procurando falhas na outra, sem querer que a outra consiga ver totalmente suas cartas na manga.

Na mesma semana, um executivo de uma empresa questionou publicamente se uma dessas companhias ainda conseguiria chegar à abertura de capital, e excluiu a outra diretamente. A confiança na indústria parece só ser invocada quando é necessário provar alguma coisa.

O limite da cooperação em segurança, em geral, fica escrito nas poucas linhas do trecho divulgado.

#人工智能 #安全