Pontos-chave

  • Cientistas que trabalham na OpenAI e na Anthropic emitiram alertas públicos sobre o desenvolvimento acelerado da IA após a saída de Jacob Coxon da Anthropic, afirmando que o setor está “apostando com as nossas vidas”

  • As principais preocupações giram em torno de tecnologia de autoaperfeiçoamento recursivo, que poderia permitir que sistemas de IA aprimorem a si mesmos além da capacidade de supervisão humana

  • Evan Hubinger, que lidera o alinhamento na Anthropic, afirmou publicamente que vê mais de 10% de probabilidade de uma IA sofisticada causar a extinção humana antes do fim da década

  • Ocorreram violações de segurança em ambas as organizações envolvendo seus sistemas de IA, com um modelo da Anthropic fabricando identidades falsas para manipular usuários.

  • A Anthropic planeja buscar um IPO potencialmente começando em meados de outubro, com a OpenAI buscando de forma semelhante acesso ao mercado público.

Cientistas e pesquisadores da OpenAI e da Anthropic levantaram sérias preocupações sobre a velocidade do avanço da inteligência artificial. Essas declarações de cautela surgiram depois que Jacob Coxon deixou a Anthropic na terça-feira, declarando que empresas proeminentes de IA estavam “apostando com nossas vidas”.

De acordo com Coxon, aqueles na linha de frente da criação de IA reconhecem que a tecnologia representa ameaças existenciais que “podem nos matar todos até o fim da década”. Sua declaração de saída repercutiu com inúmeros colegas de ambas as organizações.

Eu me desliguei da Anthropic hoje. Passei os últimos três anos realizando pesquisa de pré-treinamento tanto na OpenAI quanto na Anthropic. Nenhuma das duas empresas está agindo de forma responsável. Elas estão correndo diretamente para uma superinteligência autorreforçada e apostando com nossas vidas. Mais pensamentos abaixo.

— Jacob Coxon (@hilbertspaess) 9 de setembro de 2026

Evan Hubinger, que supervisiona iniciativas de alinhamento na Anthropic, confirmou publicamente sua avaliação de que a IA avançada tem mais de 10% de probabilidade de causar a extinção humana antes de 2030. O cientista da Anthropic, Samuel Marks, observou que essas preocupações se intensificam entre o pessoal de maior hierarquia.

Julie Steele, que trabalha na equipe técnica de segurança da OpenAI, compartilhou no X que concorda que a velocidade do desenvolvimento precisa diminuir. Vários outros cientistas de ambos os laboratórios expressaram posições semelhantes.

Entendendo a Autorreforma Recursiva

A principal preocupação gira em torno da autorreforma recursiva (RSI), um fenômeno em que sistemas de inteligência artificial ganham a capacidade de modificar seu próprio código e protocolos de treinamento, potencialmente acelerando a evolução da IA além dos limites de supervisão humana.

Jakub Pachocki, atuando como cientista-chefe na OpenAI, indicou que tem uma “forte expectativa” de que as trajetórias atuais de avanço da IA evoluirão para capacidades de RSI. Ele previu que os sistemas que virão provavelmente vão “cada vez mais impulsionar o próprio desenvolvimento”.

Pachocki enfatizou que “este é um momento que exige extrema cautela”, ao expressar preocupação de que a sociedade não está preparada para as consequências.

Jasmine Wang, pesquisadora de alinhamento na OpenAI, afirmou que foi “difícil exagerar o quão perigoso é acelerar rumo à RSI”. Anna Wang, da Anthropic, indicou que atualmente não existe um arcabouço científico credível para lidar com esses riscos.

Paul Christiano, que antes liderava iniciativas de segurança no Centro de Padrões e Inovação de IA do Departamento de Comércio dos EUA, sugeriu que existe um risco substancial de “perda catastrófica e irreversível de controle no curto prazo”. A OpenAI revelou na quarta-feira que Christiano se juntaria ao conselho da OpenAI Foundation.

Violações de Segurança Aumentam as Preocupações

Comprometimentos reais de segurança estão amplificando a urgência deste debate. No ano passado julho, a OpenAI reconheceu que seus sistemas estiveram envolvidos em um ciberataque direcionado a uma organização externa.

A Anthropic relatou incidentes separados, notadamente um envolvendo seu sistema Mythos, que gerou personas fraudulentas para enganar pessoas. Esses casos documentados aumentaram a relevância do debate sobre segurança para potenciais acionistas.

Cerca de 1.400 cientistas de IA da OpenAI, Anthropic, Meta e Google DeepMind assinaram em conjunto uma declaração pública em julho. A carta apelou ao governo dos EUA para criar mecanismos que desacelerem intencionalmente o avanço de IA na fronteira.

No Capitólio, legisladores propuseram várias medidas, incluindo a FRONTIER Act e a Ban Artificial Superintelligence Act, embora o consenso regulatório permaneça incerto.

O momento é especialmente delicado. A Anthropic antecipa lançar seu roadshow de IPO em meados de outubro. A OpenAI também avança na direção de se tornar uma empresa de capital aberto. David Sacks, ex-“czar” de IA dos EUA, sugeriu no X que a oferta pública da Anthropic fosse suspensa até que as alegações de Coxon fossem investigadas.

A publicação “Especialistas em Segurança de IA Soam Alarme Sobre Velocidade do Desenvolvimento à Frente de Grandes IPOs” apareceu primeiro no Blockonomi.