Neuigkeiten zu Sicherheit und KI

Sicherheit von KI-Agenten · Von FireAI Security & Research Team · Veröffentlicht

Bitdefender startet kostenlose macOS-Beta von AI Guardian, einer Richtlinienschicht für Claude Code und OpenClaw

Laut SecurityBrief prüft Bitdefender AI Guardian jede Aktion von Claude Code und OpenClaw vor der Ausführung gegen eine Richtlinie. Umfang und Grenzen für Mac-Nutzer.

A shield over a laptop and the FireAI radar-lab mascot, illustrating a free macOS beta that checks the actions of Claude Code and OpenClaw agents against a policy.

SecurityBrief Australia berichtete am 2. Oktober 2026, dass Bitdefender AI Guardian, ein Sicherheitswerkzeug für autonome KI-Agenten, als kostenlose öffentliche Beta für macOS veröffentlicht hat [1]. Das Werkzeug richtet sich an Entwickler, technische Fachleute und andere Nutzer, die KI-Agenten in ihrem Auftrag auf Werkzeuge, Dateien und Zugangsdaten zugreifen lassen [1]. Die erste Version unterstützt zwei Agenten, Claude Code und OpenClaw.

Hintergrund

KI-Agenten dieser Art führen Befehle aus, lesen Dateien und rufen Werkzeuge auf dem Computer der Person auf, die sie nutzt. Der Artikel beschreibt das Produkt als Mittel, Nutzern mehr Aufsicht darüber zu geben, was diese Agenten tun dürfen, und unsichere Aktionen zu stoppen, bevor sie geschehen [1]. Er zitiert unabhängige Forschung, die 20 führende KI-Agenten mit mehr als 1.300 Tool-Poisoning-Versuchen testete und eine durchschnittliche Angriffserfolgsrate von 36,5 Prozent ermittelte, wobei ein Modell in 72,8 Prozent der Fälle manipuliert wurde [1].

Was der Bericht beschreibt

Laut SecurityBrief arbeitet AI Guardian in drei Stufen: Es legt eine Richtlinien-Basis für erlaubte Werkzeuge, Dateien und Aktionen fest, prüft jede versuchte Aktion in Echtzeit gegen diese Basis und gibt vor der Ausführung ein Urteil ab: erlauben, markieren oder blockieren. Alle Entscheidungen werden in einem prüfbaren Protokoll festgehalten [1].

Der Artikel nennt als Abdeckung das Erkennen und Blockieren von Prompt-Injection-Versuchen, die Prüfung von Werkzeugen des Model Context Protocol, die Validierung von Agent Skills vor der Ausführung und die Kontrolle des Zugriffs auf offenliegende API-Schlüssel, SSH-Schlüssel und Systemzugangsdaten [1]. Die Analyse von Prompts erfolgt auf dem Gerät, einige Prüfungen nutzen Cloud-Dienste von Bitdefender [1].

Unterstützt werden Claude Code ab Version 2.1.121 und OpenClaw ab Version 2026.6.6. Die Veröffentlichung gilt nur für macOS, ohne genannten Zeitplan für andere Betriebssysteme, und ist nur auf Englisch verfügbar [1]. Bitdefenders Senior Vice President Ciprian Istrate wird mit der Aussage zitiert, KI-Agenten würden zu einer direkten Verlängerung der Nutzer, die sich auf sie verlassen, und übernähmen dieselben Sicherheitsrisiken [1].

Folgen für Mac-Nutzer

Der Bericht beschreibt eine Kontrolle zwischen einem Agenten und den Aktionen, die er auf dem Mac ausführt. Sie gilt für zwei namentlich genannte Agenten unter macOS und deckt laut Artikel weder andere Agenten noch andere Betriebssysteme ab [1]. Wer einen anderen Agenten oder eine ältere Version eines der beiden nutzt, liegt außerhalb des genannten Umfangs.

Die Zahlen zu Tool Poisoning und offenliegenden Geheimnissen stammen aus Forschung, die der Artikel zitiert, nicht aus einem Test von AI Guardian. Der abgerufene Artikel gibt nicht an, wie gut das Produkt die beschriebenen Angriffe blockiert [1].

Empfehlungen

  1. Den installierten Agenten mit den unterstützten Versionen abgleichen, bevor man sich auf eine agentenseitige Kontrolle verlässt: Claude Code ab 2.1.121 und OpenClaw ab 2026.6.6 [1].
  2. Eine Beta als Beta behandeln: nachlesen, was das Werkzeug protokolliert und wohin seine Cloud-Prüfungen Daten senden, da laut Artikel einige Prüfungen Cloud-Dienste von Bitdefender nutzen [1].
  3. API-Schlüssel und SSH-Schlüssel nach Möglichkeit aus Verzeichnissen heraushalten, in denen ein Agent arbeitet, da der Zugriff auf Zugangsdaten zu den genannten Risiken gehört [1].
  4. Die installierten Werkzeuge des Model Context Protocol und Agent Skills überprüfen und nicht benötigte entfernen.

Bezug zu FireAI

FireAI und das Produkt aus dem Bericht wirken auf unterschiedlichen Ebenen. Wie beschrieben, beurteilt AI Guardian eine Aktion eines Agenten, etwa die Nutzung eines Werkzeugs oder das Lesen einer Datei. FireAI ist eine Firewall für einen einzelnen Mac: Es erkennt eine App an ihrer Codesignatur oder ihrem Pfad, zeigt die Verbindungen, die sie öffnet, und wendet Regeln pro App darauf an. Auf einem Mac, auf dem ein Agent läuft, erscheint dieser in FireAI als das Programm, das ihn startet; eine Regel gilt also für alles, was dieses Programm ausführt, und die Seite Aktivität listet die Ziele auf, die es kontaktiert hat.

FireAI liest nicht die Anweisungen an einen Agenten, erkennt keine Prompt Injection, prüft weder Werkzeuge des Model Context Protocol noch Agent Skills und liest nicht in verschlüsselte Verbindungen hinein. Es hindert einen Agenten nicht daran, lokale Dateien zu lesen oder zu löschen, und kontrolliert nicht, welche Schlüssel ein Programm öffnen darf. Weder Claude Code noch OpenClaw sind als Integration angebunden; FireAI sieht nur ihre Netzwerkverbindungen.

Einschränkungen

Dieser Beitrag stützt sich auf einen einzigen Fachbericht. Die eigene Ankündigung von Bitdefender ließ sich nicht abrufen; die Produktdetails entsprechen daher den Angaben von SecurityBrief, und der Artikel enthält keinen Link zu einer Seite von Bitdefender [1]. Die Forschungszahlen werden im Artikel ohne Nennung einer Studie zitiert und wurden hier nicht überprüft. Ein unabhängiger Test des Produkts wird nicht angeführt.

FireAI von HisnLabs 17 Tage kostenlos testen.

Quellen

  1. SecurityBrief Australia, 2 October 2026: Bitdefender launches AI Guardian beta for Mac agents