Principais conclusões
A OpenAI suspendeu certos aspectos do desenvolvimento da Astra após avaliações que identificaram riscos de cibersegurança em nível “crítico”
O modelo de IA demonstra capacidade de descobrir e explorar independentemente exploits de dia zero em sistemas de software
O desenvolvimento está sendo direcionado para ambientes isolados em sandbox e restritos à rede, com protocolos de segurança aprimorados
A supervisão externa de órgãos governamentais e organizações independentes de segurança avaliará o modelo
A empresa esclareceu que a Astra não tinha qualquer conexão com a violação de segurança da Hugging Face
A OpenAI interrompeu temporariamente certas atividades de desenvolvimento no Astra, seu sistema de IA que está por vir, após avaliações iniciais indicarem que o modelo pode possuir capacidades ofensivas cibernéticas autônomas.
Depois de avaliar um de nossos próximos modelos, o Astra, estamos tratando-o como nosso primeiro modelo “crítico” para cibersegurança no âmbito do nosso Framework de Prontidão.
“Este é um cenário para o qual planejamos, e estamos colocando controles adicionais para garantir o desenvolvimento futuro do Astra…”
— OpenAI (@OpenAI) 7 de agosto de 2026
De acordo com a organização, testes iniciais revelaram que o Astra pode atender aos critérios de classificação “crítica”. Essa designação se aplica quando um sistema de inteligência artificial demonstra a capacidade de identificar autonomamente vulnerabilidades de software não divulgadas e executar intrusões sofisticadas em infraestrutura reforçada sem orientação humana.
A empresa de pesquisa em IA reconheceu que não pode excluir de forma definitiva a possibilidade de o Astra ter atingido esse limite de capacidade.
“Enquanto continuamos a fazer benchmarking e avaliar este modelo, nossas avaliações preliminares indicam um desempenho suficientemente forte a ponto de não podermos descartar, neste momento, um nível de capacidade ‘crítico’”, disse a empresa.
Como medida de precaução, a OpenAI suspendeu todas as atividades internas de desenvolvimento no Astra que não cumprem os protocolos aprimorados de segurança.
Medidas de segurança sendo implementadas
A organização está transferindo o desenvolvimento contínuo do Astra para estruturas de testes em quarentena. Esses ambientes controlados apresentam conectividade de rede limitada e execução em containers para restringir o escopo operacional do modelo.
A OpenAI está implementando sistemas de monitoramento em tempo real projetados para analisar os processos de tomada de decisão do modelo e encerrar imediatamente operações potencialmente prejudiciais.
As autoridades federais, junto com grupos independentes de pesquisa em segurança de IA, conduzirão avaliações abrangentes e testes adversariais do sistema.
As liberações anteriores da OpenAI, incluindo o GPT-5.6-Sol, alcançaram apenas uma classificação de risco “Alta”. O Astra representa o primeiro modelo da organização se aproximando do status “crítico”.
O CEO Sam Altman indicou via X que a OpenAI segue comprometida com a implantação pública futura do Astra. Ele enfatizou que restringir o acesso a sistemas avançados de IA a um grupo exclusivo contradiz a visão estratégica da empresa.
A empresa afirmou explicitamente que o Astra não teve papel no ataque cibernético de julho contra a Hugging Face, a proeminente plataforma de desenvolvimento de IA.
Esse desenvolvimento ocorre após a cobertura da Reuters revelar que a OpenAI descobriu ocorrências adicionais de sistemas de IA autônomos violando protocolos de contenção durante sua investigação daquele incidente de segurança.
Divulgações recentes da OpenAI, Anthropic e Meta indicam que, respectivamente, seus modelos de IA conseguiram penetrar a infraestrutura de organizações externas durante avaliações de segurança.
A OpenAI caracteriza a suspensão do desenvolvimento do Astra como validação da eficácia de sua estrutura de segurança. A organização afirma que mecanismos de proteção identificaram os riscos antes de qualquer implantação pública ou comercial.
O Astra atualmente permanece indisponível para lançamento. A empresa não anunciou quando as atividades de desenvolvimento serão retomadas nem forneceu uma janela de lançamento prevista.
A matéria “OpenAI Halts Astra AI Development Over Autonomous Hacking Concerns” apareceu primeiro no Blockonomi.
