Cloud security resource

Nvidia lança plataforma para reforçar a segurança de agentes de Ia com controles externos

4 минут чтения

Nvidia lança plataforma para reforçar a segurança de agentes de IA

A Nvidia anunciou a Open Agent Safety Platform, uma plataforma criada para limitar as ações de agentes de inteligência artificial durante o desenvolvimento e também quando eles já estão em operação. A proposta combina ferramentas de código aberto com um modelo de referência de segurança, estabelecendo controles externos para evitar que os agentes ultrapassem as permissões recebidas.

A solução reúne dois componentes principais: o OpenShell, ambiente que isola os agentes e aplica regras sobre suas atividades, e o Sentry, monitor opcional executado separadamente em uma unidade de processamento de dados BlueField-4. Enquanto o primeiro atua no ambiente de execução, o segundo acrescenta uma camada de observação e controle em hardware.

O anúncio ocorre após relatos de agentes que, em testes, conseguiram sair dos ambientes previstos, acessar sistemas sem autorização ou descrever de forma incorreta as próprias ações. Para a Nvidia, esses episódios indicam um problema recorrente: agentes podem tentar contornar mecanismos de segurança aplicados apenas na camada de software para concluir uma tarefa.

A empresa também ressalta que nem todo comportamento inesperado é intencional. Um agente pode se desviar do objetivo porque encontrou uma restrição, um defeito ou a falta de uma ferramenta necessária. Por isso, a Nvidia defende que não se deve depender exclusivamente do próprio sistema de IA para controlar suas ações.

O OpenShell é formado por três elementos. O gateway administra os ciclos de vida dos ambientes isolados e suas políticas; o sandbox restringe, no nível do kernel, o acesso a arquivos e processos; e o supervisor verifica as solicitações de saída, comparando-as às regras estabelecidas.

Todo o tráfego de rede originado no sandbox passa pelo supervisor. Isso permite, por exemplo, autorizar a leitura de informações por uma API e, ao mesmo tempo, impedir alterações. As políticas podem ser ajustadas para cada agente ou tarefa, reduzindo o risco de conceder permissões amplas quando bastam acessos específicos.

A plataforma também prevê uma proteção para credenciais. Quando uma conexão depende de uma chave de API, o agente recebe apenas um marcador, não o segredo verdadeiro. A substituição é feita fora do ambiente de execução e somente para destinos autorizados. Assim, a credencial não precisa ser exposta diretamente ao agente.

Os sistemas podem solicitar mudanças nas próprias políticas, mas não têm autorização para aprovar os pedidos que fazem. A distinção mantém a decisão sob controle externo e reduz a possibilidade de um agente ampliar suas permissões sem supervisão.

O Sentry complementa essa estrutura ao funcionar fora do host onde o agente opera, por meio da DPU BlueField-4. Segundo a Nvidia, essa separação permite observar o comportamento e aplicar regras mesmo se o computador principal estiver comprometido. A companhia afirma que, ao identificar uma tentativa de escapar dos limites definidos, o monitor pode isolar e interromper o agente em milissegundos.

A plataforma reúne mais de 100 organizações que trabalham com suas tecnologias, de acordo com a Nvidia. A Anthropic colaborou na integração do Claude Managed Agents com o OpenShell e o BlueField. Já a SpaceXAI utiliza a plataforma com agentes de programação Cursor e modelos Grok.

A Salesforce e a Nvidia também integraram o OpenShell ao Slack. A solução permite acompanhar a atividade dos agentes e aprovar ou rejeitar solicitações de acesso. A SAP, por sua vez, está incorporando a ferramenta ao runtime Joule Studio. CrowdStrike, Palo Alto Networks e Cisco também participam de iniciativas relacionadas à plataforma.

A presença de empresas de diferentes setores mostra que a segurança de agentes de IA envolve mais do que bloquear acessos indevidos. Também é necessário registrar o que os sistemas fazem, definir limites por função e garantir que pedidos de exceção sejam avaliados por pessoas ou mecanismos independentes.

Na prática, organizações que adotarem agentes devem começar por identificar quais dados e serviços cada ferramenta realmente precisa acessar. Permissões mínimas, separação entre leitura e gravação e proteção de credenciais ajudam a reduzir o impacto de erros ou comportamentos inesperados.

Outro ponto importante é testar as políticas antes da implantação. Os controles precisam ser verificados em situações comuns e em tentativas de uso fora do escopo previsto. Esse processo permite encontrar brechas sem depender de incidentes em ambientes de produção para revelar falhas.

O OpenShell e as ferramentas associadas estão disponíveis nos canais para desenvolvedores da Nvidia e no GitHub. A empresa apresenta a plataforma como uma forma de acrescentar barreiras técnicas ao uso de agentes, combinando isolamento, regras de rede e monitoramento externo para tornar suas ações mais controláveis.