Notícias sobre segurança e IA

Segurança de agentes de IA · Por FireAI Security & Research Team · Publicado

A Bitdefender abre uma beta gratuita para macOS do AI Guardian, uma camada de políticas para agentes Claude Code e OpenClaw

Segundo a SecurityBrief, o Bitdefender AI Guardian verifica cada ação dos agentes Claude Code e OpenClaw face a uma política antes de a executar. Âmbito e limites.

A shield over a laptop and the FireAI radar-lab mascot, illustrating a free macOS beta that checks the actions of Claude Code and OpenClaw agents against a policy.

A SecurityBrief Australia noticiou a 2 de outubro de 2026 que a Bitdefender lançou o AI Guardian, uma ferramenta de segurança para agentes de IA autónomos, como beta pública gratuita para macOS [1]. A ferramenta destina-se a programadores, profissionais técnicos e outros utilizadores que dependem de agentes de IA para aceder a ferramentas, ficheiros e credenciais em seu nome [1]. A versão inicial suporta dois agentes, o Claude Code e o OpenClaw.

Contexto

Os agentes de IA deste tipo executam comandos, leem ficheiros e chamam ferramentas no computador da pessoa que os usa. O artigo descreve o produto como uma forma de dar aos utilizadores mais supervisão sobre o que esses agentes podem fazer e de travar ações inseguras antes de acontecerem [1]. Cita uma investigação independente que testou 20 agentes de IA de referência contra mais de 1300 tentativas de envenenamento de ferramentas e encontrou uma taxa média de êxito dos ataques de 36,5 por cento, tendo um dos modelos sido manipulado em 72,8 por cento das vezes [1].

O que descreve a notícia

Segundo a SecurityBrief, o AI Guardian funciona em três fases: define uma base de políticas para as ferramentas, ficheiros e ações permitidos, verifica em tempo real cada ação tentada face a essa base e devolve um veredicto de permitir, assinalar ou bloquear antes de a ação prosseguir. Todas as decisões ficam registadas num registo auditável [1].

O artigo enumera como âmbito a deteção e o bloqueio de tentativas de prompt injection, a inspeção de ferramentas do Model Context Protocol, a validação de competências (skills) de agentes antes da execução e o controlo do acesso a chaves de interfaces de programação expostas, chaves de secure shell e credenciais do sistema [1]. A análise de prompts é feita no dispositivo, e algumas verificações usam os serviços na nuvem da Bitdefender [1].

As versões suportadas são o Claude Code 2.1.121 ou posterior e o OpenClaw 2026.6.6 ou posterior. A versão destina-se apenas ao macOS, sem calendário indicado para outros sistemas operativos, e está disponível apenas em inglês [1]. O vice-presidente sénior da Bitdefender, Ciprian Istrate, é citado afirmando que os agentes de IA se estão a tornar uma extensão direta dos utilizadores que deles dependem, herdando os mesmos riscos de segurança [1].

Implicações para os utilizadores de Mac

A notícia descreve um controlo colocado entre um agente e as ações que este executa no Mac. Aplica-se a dois agentes identificados no macOS e, segundo o artigo, não abrange outros agentes nem outros sistemas operativos [1]. Quem usa outro agente, ou uma versão mais antiga de qualquer um dos dois, fica fora do âmbito indicado.

Os números sobre envenenamento de ferramentas e segredos expostos provêm de investigação citada pelo artigo e não de um teste ao AI Guardian. O artigo, tal como foi consultado, não indica em que medida o produto bloqueia os ataques que descreve [1].

Recomendações

  1. Comparar o agente instalado com as versões suportadas antes de confiar em qualquer controlo do lado do agente: Claude Code 2.1.121 ou posterior e OpenClaw 2026.6.6 ou posterior [1].
  2. Tratar uma beta como uma beta: ler o que a ferramenta regista e para onde as suas verificações na nuvem enviam dados, já que o artigo indica que algumas verificações usam os serviços na nuvem da Bitdefender [1].
  3. Manter, sempre que possível, as chaves de API e de secure shell fora das pastas em que um agente trabalha, uma vez que o acesso a credenciais é um dos riscos enumerados [1].
  4. Rever as ferramentas do Model Context Protocol e as competências de agentes instaladas e remover as que não são necessárias.

Relevância para a FireAI

A FireAI e o produto da notícia atuam em camadas diferentes. Tal como descrito, o AI Guardian avalia a ação de um agente, como usar uma ferramenta ou ler um ficheiro. A FireAI é uma firewall para um só Mac: identifica uma app pela sua assinatura de código ou caminho, mostra as ligações que a app abre e aplica-lhes regras por app. Num Mac que executa um agente, este aparece na FireAI como o programa que o lança, pelo que uma regra se aplica a tudo o que esse programa executa, e a página Atividade lista os destinos que contactou.

A FireAI não lê as instruções dadas a um agente, não deteta prompt injection, não inspeciona ferramentas do Model Context Protocol nem competências de agentes e não lê o interior de uma ligação cifrada. Não impede um agente de ler ou apagar ficheiros locais nem controla que chaves um programa pode abrir. Não oferece integração com o Claude Code nem com o OpenClaw; vê apenas as suas ligações de rede.

Limitações

Este artigo baseia-se numa única notícia do setor. Não foi possível obter o anúncio da própria Bitdefender, pelo que os pormenores do produto são os indicados pela SecurityBrief, e o artigo não contém ligação para nenhuma página da Bitdefender [1]. Os números da investigação são citados pelo artigo sem identificação do estudo, e este artigo não os verificou. Não é citado nenhum teste independente do produto.

Experimente a FireAI, da HisnLabs gratuitamente durante 17 dias.

Fontes

  1. SecurityBrief Australia, 2 October 2026: Bitdefender launches AI Guardian beta for Mac agents