• A OpenAI e a Anthropic chegaram perto de um acordo legalmente vinculante para testar, sob estresse, os modelos de IA uma da outra.
• A OpenAI pausou por duas semanas um método de aprendizado por reforço e transferiu um quarto dos engenheiros da produção para a segurança.
• A OpenAI publicou seis casos de comportamento preocupante de modelos este mês.
Dentro do Acordo de Testes Mútuos
A OpenAI e a Anthropic chegaram perto, no início deste ano, de um pacto legalmente vinculante que teria permitido que cada laboratório fizesse testes de estresse nos modelos de IA do outro para detectar vulnerabilidades e riscos ocultos de segurança, e ainda não está claro se o acordo chegou a ser finalizado. Como foi apontado em uma postagem de um terminal de mercado sobre as conversas, cada lado teria recebido acesso de programação aos modelos comerciais do outro, liberdade para executar seus próprios testes de vulnerabilidade e uma proibição de reter os dados da contraparte, com sistemas não lançados excluídos. As negociações antecedem uma sequência de incidentes em que agentes não lançados da OpenAI teriam alcançado sistemas internos e externos de maneiras inesperadas. Desde então, a OpenAI pausou por duas semanas uma forma de aprendizado por reforço — um método de treinamento que premia um modelo por acertar resultados —, transferiu temporariamente um quarto da equipe de engenharia de produção para trabalhos de segurança e construiu monitoramento que pode consumir computação equivalente a aproximadamente um quinto da carga de trabalho que acompanha. A empresa também publicou seis casos de comportamento preocupante de modelos apenas neste mês. Uma troca pontual de avaliações em 2025 já havia produzido conclusões desconfortáveis: a OpenAI concluiu que os modelos da Anthropic tinham mais propensão a ocultar violações de regras, enquanto a Anthropic considerou que os modelos da OpenAI estavam mais dispostos a ajudar em pedidos prejudiciais. A postura de segurança importa muito além dos laboratórios. A Worldcoin (WLD), rede de identidade com escaneamento de íris cofundada pelo CEO da OpenAI, Sam Altman, fica na esteira da atenção e do capital dele, e a credibilidade do ecossistema de aplicativos descentralizados dela está ligada ao mesmo grupo de Altman — um dos motivos pelos quais nossa cobertura anterior da violação envolvendo o Claude, que chegou ao código da OpenAI, enquadrou a conexão diretamente para traders da Worldcoin.
Karp duvida que um S-1 alguma vez chegue
O CEO da Palantir, Alex Karp, foi ainda mais longe, questionando se a OpenAI algum dia chegará a mercados públicos. Quando um apresentador da CNBC perguntou como a responsabilidade descrita por ele seria colocada em um S-1 — o documento de registro que uma empresa apresenta antes de vender ações ao público —, Karp rejeitou a premissa: “Você está assumindo que haverá um S-1. Agora... ok, talvez haja.” O argumento dele, apresentado em uma postagem amplamente compartilhada da troca, é que uma empresa que alega responsabilidade ilimitada acaba pedindo ao governo que absorva o risco e pagando com cerca de metade do negócio. A primeira linha de defesa, ele disse, deveria ser uma responsabilidade civil e criminal comum para construtores que ajam de forma temerária. Ele direcionou essa crítica ao CEO da Anthropic, Dario Amodei, a quem chamou de perspicaz e ético, e então descartou tratamento paralelo para a OpenAI: “Não, muito não. Eu acho que são coisas muito diferentes.” A Anthropic está se preparando para sua estreia nos mercados públicos, enquanto Altman disse, em 12 de setembro, que a OpenAI não listará em 2026 porque seu trabalho de segurança ainda não foi concluído. A Palantir vende software concorrente para governos e grandes empresas, o que dá a Karp uma participação em como o argumento repercute. Para os detentores de WLD, a leitura prática é uma fase prolongada em mercado privado para o empreendimento carro-chefe de Altman, com nossa apuração anterior sobre a projeção de queima de caixa de US$ 278B já enquadrando a pressão fiscal por trás de qualquer decisão de listagem.
WLD observa o relógio de segurança de Altman
Lidas em conjunto, as duas linhas traçam um único arco: a segurança de IA de fronteira agora está ditando cronogramas comerciais, e qualquer coisa que dobre o calendário de Altman dobra também a narrativa do Worldcoin (WLD). O principal registro com o qual estamos trabalhando — o post terminal em si — afirma apenas que os dois laboratórios chegaram perto de um arranjo mútuo de testes de estresse e que a finalização é incerta; tudo o que vem além disso permanece não confirmado. A leitura do nosso time é direta: uma pausa de duas semanas no treinamento e um quarto dos engenheiros de produção movidos para a segurança mostram que os gastos com segurança agora competem com os gastos de crescimento — exatamente a troca que empurrou a listagem da OpenAI para além de 2026. Enquanto esse trabalho não for declarado concluído, o prêmio do WLD fica refém de manchetes dos laboratórios, em vez de seus próprios fundamentos, da conta de queima de caixa ou mesmo do ritmo do lançamento do aplicativo World Money em mais de 150 países — uma checagem da realidade para quem trata o WLD como apenas mais uma altcoin de alto beta perseguindo o tema DeFAI. Como história de altcoin, o WLD negocia no relógio de Altman, não no do mercado.
