A Nvidia disponibilizou nesta segunda-feira um conjunto de ferramentas voltadas à segurança de agentes de inteligência artificial. Segundo a empresa, os recursos poderiam ter impedido a invasão da Hugging Face, plataforma de desenvolvimento de código para IA adquirida pela Nvidia por US$13 bilhões meses depois do ataque.
O lançamento ocorre enquanto OpenAI e Anthropic investigam casos em que agentes — sistemas capazes de executar tarefas complexas — acessaram sistemas comerciais e governamentais. A Nvidia apresentou o problema como uma questão de engenharia, em vez de defender regulamentações amplas para a segurança da IA.
Isolamento e interrupção de agentes
Uma das ferramentas, chamada OpenShell, usa recursos de hardware dos processadores centrais da Nvidia para isolar e conter agentes de IA. A empresa informou que trabalha com Arm Holdings e Intel para que o sistema também funcione em processadores dessas companhias.
As ferramentas são lançadas com dezenas de parceiros, entre eles a Anthropic. Justin Boitano, vice-presidente e diretor-geral de computação corporativa da Nvidia, afirmou que a solução poderia ter evitado o ataque à Hugging Face revelado em meados do ano.
“Essa nova plataforma de segurança poderia ter evitado a violação”, disse Boitano durante uma coletiva de imprensa. Ele afirmou ainda que a Nvidia pretende desenvolver a iniciativa de forma aberta e envolver outras empresas no trabalho.
Outro sistema, chamado Sentry, combina um chip separado da Nvidia com o OpenShell. A função é interromper um agente descontrolado caso ele tente escapar do ambiente isolado, conhecido como container, em um processador central.
As ferramentas também usam fórmulas matemáticas para identificar tentativas de contornar os mecanismos de proteção. Ali Golshan, diretor sênior de software de IA da Nvidia, citou como exemplo situações em que um agente cria vários subagentes para driblar o bloqueio do agente principal. Para ele, o comportamento envolve frotas de agentes e a maneira como operam em conjunto.



