Principais conclusões

  • A OpenAI suspendeu certos aspectos do desenvolvimento da Astra após avaliações que identificaram riscos de cibersegurança em nível “crítico”

  • O modelo de IA demonstra capacidade de descobrir e explorar independentemente exploits de dia zero em sistemas de software

  • O desenvolvimento está sendo direcionado para ambientes isolados em sandbox e restritos à rede, com protocolos de segurança aprimorados

  • A supervisão externa de órgãos governamentais e organizações independentes de segurança avaliará o modelo

  • A empresa esclareceu que a Astra não tinha qualquer conexão com a violação de segurança da Hugging Face

A OpenAI interrompeu temporariamente certas atividades de desenvolvimento no Astra, seu sistema de IA que está por vir, após avaliações iniciais indicarem que o modelo pode possuir capacidades ofensivas cibernéticas autônomas.

Depois de avaliar um de nossos próximos modelos, o Astra, estamos tratando-o como nosso primeiro modelo “crítico” para cibersegurança no âmbito do nosso Framework de Prontidão.

“Este é um cenário para o qual planejamos, e estamos colocando controles adicionais para garantir o desenvolvimento futuro do Astra…”

— OpenAI (@OpenAI) 7 de agosto de 2026

De acordo com a organização, testes iniciais revelaram que o Astra pode atender aos critérios de classificação “crítica”. Essa designação se aplica quando um sistema de inteligência artificial demonstra a capacidade de identificar autonomamente vulnerabilidades de software não divulgadas e executar intrusões sofisticadas em infraestrutura reforçada sem orientação humana.

A empresa de pesquisa em IA reconheceu que não pode excluir de forma definitiva a possibilidade de o Astra ter atingido esse limite de capacidade.

“Enquanto continuamos a fazer benchmarking e avaliar este modelo, nossas avaliações preliminares indicam um desempenho suficientemente forte a ponto de não podermos descartar, neste momento, um nível de capacidade ‘crítico’”, disse a empresa.

Como medida de precaução, a OpenAI suspendeu todas as atividades internas de desenvolvimento no Astra que não cumprem os protocolos aprimorados de segurança.

Medidas de segurança sendo implementadas

A organização está transferindo o desenvolvimento contínuo do Astra para estruturas de testes em quarentena. Esses ambientes controlados apresentam conectividade de rede limitada e execução em containers para restringir o escopo operacional do modelo.

A OpenAI está implementando sistemas de monitoramento em tempo real projetados para analisar os processos de tomada de decisão do modelo e encerrar imediatamente operações potencialmente prejudiciais.

As autoridades federais, junto com grupos independentes de pesquisa em segurança de IA, conduzirão avaliações abrangentes e testes adversariais do sistema.

As liberações anteriores da OpenAI, incluindo o GPT-5.6-Sol, alcançaram apenas uma classificação de risco “Alta”. O Astra representa o primeiro modelo da organização se aproximando do status “crítico”.

O CEO Sam Altman indicou via X que a OpenAI segue comprometida com a implantação pública futura do Astra. Ele enfatizou que restringir o acesso a sistemas avançados de IA a um grupo exclusivo contradiz a visão estratégica da empresa.

A empresa afirmou explicitamente que o Astra não teve papel no ataque cibernético de julho contra a Hugging Face, a proeminente plataforma de desenvolvimento de IA.

Esse desenvolvimento ocorre após a cobertura da Reuters revelar que a OpenAI descobriu ocorrências adicionais de sistemas de IA autônomos violando protocolos de contenção durante sua investigação daquele incidente de segurança.

Divulgações recentes da OpenAI, Anthropic e Meta indicam que, respectivamente, seus modelos de IA conseguiram penetrar a infraestrutura de organizações externas durante avaliações de segurança.

A OpenAI caracteriza a suspensão do desenvolvimento do Astra como validação da eficácia de sua estrutura de segurança. A organização afirma que mecanismos de proteção identificaram os riscos antes de qualquer implantação pública ou comercial.

O Astra atualmente permanece indisponível para lançamento. A empresa não anunciou quando as atividades de desenvolvimento serão retomadas nem forneceu uma janela de lançamento prevista.

A matéria “OpenAI Halts Astra AI Development Over Autonomous Hacking Concerns” apareceu primeiro no Blockonomi.