#OpenAISaysAstraFindsFlawsAutonomously
A OpenAI diz que seu novo 'Astra' de IA pode criar ataques sem ajuda humana.
Astra é o primeiro modelo da OpenAI a atingir seu limite de cibersegurança “Crítico”, o que significa que pode encontrar vulnerabilidades previamente desconhecidas e desenvolver formas de explorá-las em sistemas reforçados.
A OpenAI afirma que o modelo Astra, que está por vir, pode encontrar falhas de software previamente desconhecidas e transformá-las em ataques funcionais sem que uma pessoa oriente cada etapa, ultrapassando um limite de cibersegurança que até recentemente pertencia em grande parte a equipes especializadas em hacking.
Para se qualificar, um modelo deve ser capaz de encontrar falhas de software previamente desconhecidas, conhecidas como zero-days, e desenvolver exploits funcionais para elas em sistemas reais reforçados, sem intervenção humana, ou então planejar e executar um ataque a partir de algo pouco mais do que um objetivo de alto nível.
Nos testes, a Astra obteve 100% em um benchmark para desenvolver exploits a partir de vulnerabilidades conhecidas e encontrou duas falhas previamente desconhecidas ao montar uma cadeia de exploração em um teste interno separado.
Ela também conseguiu sair de um sandbox reforçado de navegador e executar comandos no computador host, ao mesmo tempo em que, separadamente, encontrou e combinou múltiplas falhas em um sistema operacional para obter acesso root, disse a OpenAI.
A empresa, desde então, adiou partes do desenvolvimento do Astra enquanto adicionava salvaguardas e planeja, inicialmente, restringir suas capacidades mais avançadas de cibersegurança a testadores selecionados.
A OpenAI diz que seu novo 'Astra' de IA pode criar ataques sem ajuda humana.
Astra é o primeiro modelo da OpenAI a atingir seu limite de cibersegurança “Crítico”, o que significa que pode encontrar vulnerabilidades previamente desconhecidas e desenvolver formas de explorá-las em sistemas reforçados.
A OpenAI afirma que o modelo Astra, que está por vir, pode encontrar falhas de software previamente desconhecidas e transformá-las em ataques funcionais sem que uma pessoa oriente cada etapa, ultrapassando um limite de cibersegurança que até recentemente pertencia em grande parte a equipes especializadas em hacking.
Para se qualificar, um modelo deve ser capaz de encontrar falhas de software previamente desconhecidas, conhecidas como zero-days, e desenvolver exploits funcionais para elas em sistemas reais reforçados, sem intervenção humana, ou então planejar e executar um ataque a partir de algo pouco mais do que um objetivo de alto nível.
Nos testes, a Astra obteve 100% em um benchmark para desenvolver exploits a partir de vulnerabilidades conhecidas e encontrou duas falhas previamente desconhecidas ao montar uma cadeia de exploração em um teste interno separado.
Ela também conseguiu sair de um sandbox reforçado de navegador e executar comandos no computador host, ao mesmo tempo em que, separadamente, encontrou e combinou múltiplas falhas em um sistema operacional para obter acesso root, disse a OpenAI.
A empresa, desde então, adiou partes do desenvolvimento do Astra enquanto adicionava salvaguardas e planeja, inicialmente, restringir suas capacidades mais avançadas de cibersegurança a testadores selecionados.