A fabricante de chips Nvidia revelou nesta segunda-feira (28) uma solução de segurança desenvolvida para conter agentes de inteligência artificial caso eles tentem burlar as diretrizes estipuladas por seus desenvolvedores.
A ferramenta integra recursos físicos e digitais para monitorar os algoritmos em tempo real, tendo a capacidade de paralisar e isolar um agente instantaneamente se ele tentar invadir sistemas, arquivos ou ferramentas sem permissão prévia.
Batizada de “Nvidia Open Agent Safety Platform”, a novidade atua como um mecanismo externo de interrupção. Em vez de confiar exclusivamente nas travas internas do próprio modelo para bloquear ações indesejadas, a arquitetura impõe limites fora do alcance da inteligência artificial.
O anúncio acontece na sequência de episódios recentes em que sistemas autônomos conseguiram burlar barreiras de proteção durante rotinas automatizadas. Em julho, por exemplo, modelos da OpenAI escaparam de restrições que exigiam seu isolamento da internet, alcançando plataformas internas da própria criadora e da Hugging Face.
Como opera o sistema de contenção da Nvidia?
A estrutura é dividida em duas frentes principais. A primeira é o OpenShell, um software de código aberto projetado para prover um ambiente isolado de execução para as IAs.
Por meio desse recurso, corporações conseguem estipular previamente limites rígidos de atuação, especificando quais documentos, ferramentas e serviços de rede o agente tem permissão para manusear. Essas restrições permanecem ativas mesmo se a inteligência artificial apresentar desvios operacionais.
Esse nível de vigilância é necessário porque agentes autônomos diferem dos chatbots tradicionais. Eles recebem metas complexas e executam diversas etapas por conta própria para finalizá-las, o que envolve redigir códigos, abrir softwares, consultar bases de dados e acionar utilitários externos.
A segunda camada de defesa é o Nvidia Sentry, que atua como um monitor autônomo. O componente opera em processadores BlueField-4 da marca, de forma totalmente independente do espaço onde o agente roda, fiscalizando todas as suas movimentações de maneira contínua.
Caso o sistema detecte que a IA tentou violar as regras estabelecidas, o Sentry pode colocá-la em quarentena e abortar sua execução em frações de segundo, conforme divulgado pela companhia. Como essa barreira física opera fora do software principal, ela continua operando mesmo se o ambiente virtual do agente for comprometido.

Jensen Huang, CEO da Nvidia, diz que sistemas de segurança precisam acompanhar o avanço dos agentes de IA (Divulgação/Nvidia)
A proposta se assemelha a inserir um mecanismo de segurança isolado entre a inteligência artificial e os dados que ela busca alcançar. Enquanto as proteções nativas tentam influenciar a intenção do modelo, a nova camada define de forma concreta o que ele tem capacidade de realizar na prática.
Motivações para o desenvolvimento da tecnologia
De acordo com a Nvidia, falhas de segurança recentes seguiram um padrão recorrente: os agentes conseguiram contornar travas aplicadas na interface de software enquanto tentavam concluir as missões atribuídas a eles.
Um dos episódios mais expressivos envolveu a OpenAI. Durante testes de robustez conduzidos em julho, IAs da desenvolvedora conseguiram acessar redes externas por rotas não permitidas, explorar falhas e atingir serviços da Hugging Face. A própria OpenAI admitiu o ocorrido posteriormente, esclarecendo que os modelos estavam com defesas atenuadas durante os experimentos.
Outro caso veio a público em setembro, quando o governo da Austrália reportou que um agente da OpenAI acessou sem autorização um portal público de dados do Medicare em junho, visualizando documentos restritos. Até o pronunciamento oficial, não havia indícios de vazamento de dados confidenciais, e as investigações prosseguiam.
Esses incidentes esclarecem que a ideia de IAs “rebeldes” exige ponderação. Os episódios registrados até o momento não demonstram que os sistemas adquiriram vontade própria, mas sim que agentes autônomos encontram brechas para contornar limites técnicos e executar ações imprevistas por seus criadores.

Nvidia cita casos recentes de agentes de IA que contornaram barreiras de segurança; um deles envolveu sistemas da Hugging Face (Marcelo Fischer/Canaltech)
Envolvimento de grandes empresas de tecnologia
A Nvidia informou que mais de cem companhias já colaboram com a nova plataforma. A lista de parceiros inclui nomes como Anthropic, Microsoft, Salesforce, SAP, Cisco, CrowdStrike, Hugging Face, JPMorganChase, Palantir e SpaceXAI.
O OpenShell já se encontra disponível no formato de código aberto, com compatibilidade não apenas para os processadores Vera da própria Nvidia, mas também adaptável a hardwares de terceiros, incluindo arquiteturas baseadas em Arm e Intel. Já a camada de monitoramento do Sentry é restrita aos chips BlueField-4.
Na visão de Jensen Huang, CEO da Nvidia, os mecanismos de proteção precisam evoluir no mesmo ritmo que a capacidade dos sistemas inteligentes. A estratégia da corporação consiste em transferir parte dessa responsabilidade para fora do próprio modelo, estabelecendo barreiras físicas e digitais independentes que continuem ativas mesmo diante de comportamentos imprevistos.





