A Nvidia (NVDA) lançou na segunda-feira sua Open Agent Safety Platform para conter agentes autônomos com supervisão humana mínima que executam código, movimentam fundos ou tocam sistemas sensíveis.
Principais conclusões
A Nvidia lançou na segunda-feira sua Open Agent Safety Platform para agentes autônomos que executam código, movimentam fundos ou acessam sistemas sensíveis
A plataforma combina o OpenShell, um runtime isolado em sandbox, com o Sentry, uma camada de monitoramento
O OpenShell isola a execução de cada agente para que uma violação não possa se espalhar para o armazenamento, containers ou a rede mais ampla
A Vision One da TrendAI agora cobre agentes, modelos, containers, armazenamento e redes em um único painel
A Nvidia detalhou a plataforma como um runtime isolado, o OpenShell, emparelhado com o Sentry, uma camada de monitoramento.
Ele descreve o OpenShell como um ambiente de zero trust em que nada é permitido por padrão, em resposta ao aviso de meses feito a pesquisadores de que agentes frequentemente recebem mais permissões do que a tarefa exige.
Um agente de IA é um programa de modelo de linguagem que realiza ações em múltiplas etapas, navega na web, escreve e executa código, ou chama outro software, em vez de apenas responder a um prompt de chat.
Essa autonomia pode ajudar no gerenciamento de frotas ou na codificação, mas também torna um agente comprometido ou direcionado de forma errada perigoso. O OpenShell isola a execução de cada agente para que uma violação em um sandbox não se espalhe para o armazenamento, containers ou a rede mais ampla que ele contata.
Leia também: Autoridades chinesas de segurança da IA rejeitam enquadramento de risco existencial dos EUA
A fornecedora de segurança TrendAI disse na segunda-feira que está expandindo a plataforma da Nvidia com sua própria camada de inteligência contra ameaças, parceria que a Nvidia citou em seu anúncio.
A Vision One da TrendAI agora cobre agentes, modelos, containers, armazenamento e redes em um único painel, ampliando a cobertura que antes parava na camada de modelo.
Por que a segurança de agentes virou um problema para a Nvidia resolver
A Nvidia passou 2026 se posicionando como a camada de infraestrutura abaixo da capacidade de computação de cada grande laboratório de IA. Seus data centers, cada vez mais, hospedam agentes construídos por OpenAI, Anthropic e clientes empresariais que executam transações financeiras e gerenciam infraestrutura sem que um humano aprove cada etapa.
Incidentes de segurança de agentes se acumularam neste trimestre, incluindo um agente da OpenAI que violou um portal de saúde australiano sem autorização.
A Nvidia enquadra todo o pipeline de agentes, a “fábrica de IA”, como a unidade que precisa de proteção — não apenas o modelo.
A distância entre a segurança do modelo e a segurança da plataforma de agentes
A maior parte dos gastos com segurança de IA se concentrou em filtrar a saída de chatbots. Agentes apresentam um risco separado porque agem no mundo, e uma ação permitida por permissões nem sempre pode ser desfeita.
A Nvidia diz que o Sentry monitora o comportamento em tempo real e pode interromper um agente no meio da tarefa se ele se desviar da política atribuída, diferenciando-se de ferramentas reativas que sinalizam problemas depois que o dano já ocorreu.
Para construtores independentes, as questões práticas permanecem os termos da plataforma, o acesso e a sobrecarga de desempenho. As empresas precisam decidir se adotam o bloqueio no nível do hardware de forma voluntária.
Leia a seguir: Pagamentos por agentes de IA com lançamento no Cardano com suporte X402