Wiadomości dotyczące bezpieczeństwa i sztucznej inteligencji

Bezpieczeństwo agentów AI · Autor FireAI Security & Research Team · Opublikowano

Bitdefender udostępnia bezpłatną betę AI Guardian dla macOS, warstwę zasad dla agentów Claude Code i OpenClaw

SecurityBrief podaje, że Bitdefender AI Guardian sprawdza każde działanie agentów Claude Code i OpenClaw względem zasad przed wykonaniem. Zakres i ograniczenia dla Maca.

A shield over a laptop and the FireAI radar-lab mascot, illustrating a free macOS beta that checks the actions of Claude Code and OpenClaw agents against a policy.

SecurityBrief Australia poinformował 2 października 2026 r., że Bitdefender uruchomił AI Guardian, narzędzie bezpieczeństwa dla autonomicznych agentów AI, w formie bezpłatnej publicznej wersji beta dla macOS [1]. Narzędzie jest skierowane do deweloperów, praktyków technicznych i innych użytkowników, którzy powierzają agentom AI dostęp do narzędzi, plików i poświadczeń w swoim imieniu [1]. Pierwsze wydanie obsługuje dwa agenty: Claude Code i OpenClaw.

Tło

Agenci AI tego rodzaju wykonują polecenia, czytają pliki i wywołują narzędzia na komputerze osoby, która z nich korzysta. Artykuł opisuje produkt jako dający użytkownikom większy nadzór nad tym, co ci agenci mogą robić, i zatrzymujący niebezpieczne działania, zanim do nich dojdzie [1]. Przywołuje niezależne badanie, w którym 20 czołowych agentów AI poddano ponad 1300 próbom zatruwania narzędzi (tool poisoning) i stwierdzono średnią skuteczność ataków na poziomie 36,5 procent, przy czym jeden model dawał się zmanipulować w 72,8 procent przypadków [1].

Co opisuje artykuł

Według SecurityBrief AI Guardian działa w trzech etapach: ustala bazowe zasady dotyczące dozwolonych narzędzi, plików i działań, sprawdza w czasie rzeczywistym każde podejmowane działanie względem tych zasad i przed jego wykonaniem zwraca werdykt: zezwól, oznacz lub zablokuj. Wszystkie decyzje są zapisywane w dzienniku umożliwiającym audyt [1].

Artykuł wymienia jako zakres działania wykrywanie i blokowanie prób prompt injection, sprawdzanie narzędzi Model Context Protocol, weryfikację umiejętności agentów przed wykonaniem oraz kontrolę dostępu do ujawnionych kluczy interfejsów programistycznych, kluczy SSH i poświadczeń systemowych [1]. Analiza promptów odbywa się na urządzeniu, a niektóre kontrole korzystają z usług chmurowych Bitdefender [1].

Obsługiwane wersje to Claude Code 2.1.121 lub nowszy oraz OpenClaw 2026.6.6 lub nowszy. Wydanie jest przeznaczone wyłącznie dla macOS, bez podanego harmonogramu dla innych systemów operacyjnych, i dostępne tylko w języku angielskim [1]. Artykuł cytuje starszego wiceprezesa Bitdefender Ciprian Istrate, według którego agenci AI stają się bezpośrednim przedłużeniem korzystających z nich użytkowników i dziedziczą te same zagrożenia bezpieczeństwa [1].

Znaczenie dla użytkowników Maca

Artykuł opisuje mechanizm kontroli umieszczony między agentem a działaniami, które podejmuje on na Macu. Dotyczy dwóch wymienionych agentów na macOS i, według artykułu, nie obejmuje innych agentów ani innych systemów operacyjnych [1]. Osoba korzystająca z innego agenta lub ze starszej wersji któregoś z nich znajduje się poza deklarowanym zakresem.

Dane dotyczące zatruwania narzędzi i ujawnionych sekretów pochodzą z badań przywołanych w artykule, a nie z testu AI Guardian. Artykuł w pobranej wersji nie podaje, jak skutecznie produkt blokuje opisywane ataki [1].

Zalecenia

  1. Przed poleganiem na jakiejkolwiek kontroli po stronie agenta sprawdź zainstalowaną wersję względem obsługiwanych: Claude Code 2.1.121 lub nowszy oraz OpenClaw 2026.6.6 lub nowszy [1].
  2. Traktuj wersję beta jak wersję beta: sprawdź, co narzędzie rejestruje i dokąd jego kontrole chmurowe wysyłają dane, ponieważ artykuł podaje, że niektóre kontrole korzystają z usług chmurowych Bitdefender [1].
  3. W miarę możliwości trzymaj klucze API i klucze SSH poza katalogami, w których pracuje agent, ponieważ dostęp do poświadczeń jest jednym z wymienionych zagrożeń [1].
  4. Przejrzyj zainstalowane narzędzia Model Context Protocol i umiejętności agentów i usuń te, które nie są potrzebne.

Związek z FireAI

FireAI i opisany produkt działają w różnych warstwach. Zgodnie z opisem AI Guardian ocenia działanie agenta, takie jak użycie narzędzia czy odczyt pliku. FireAI to zapora dla jednego Maca: rozpoznaje aplikację po podpisie kodu lub ścieżce, pokazuje otwierane przez nią połączenia i stosuje do nich reguły dla aplikacji. Mac, na którym działa agent, widnieje w FireAI jako program, który go uruchamia, więc reguła obejmuje wszystko, co ten program uruchamia, a strona Aktywność wyświetla cele, z którymi się łączył.

FireAI nie czyta instrukcji przekazywanych agentowi, nie wykrywa prompt injection, nie sprawdza narzędzi Model Context Protocol ani umiejętności agentów i nie zagląda do wnętrza szyfrowanych połączeń. Nie powstrzymuje agenta przed odczytem lub usunięciem plików lokalnych i nie kontroluje, które klucze program może otworzyć. Nie oferuje integracji ani z Claude Code, ani z OpenClaw; widzi wyłącznie ich połączenia sieciowe.

Ograniczenia

Ten wpis opiera się na jednym artykule branżowym. Nie udało się pobrać własnego komunikatu Bitdefender, więc szczegóły produktu podano tak, jak przedstawia je SecurityBrief, a artykuł nie zawiera linku do strony Bitdefender [1]. Dane z badań są przywołane w artykule bez wskazania konkretnego badania i nie zostały tu zweryfikowane. Nie przywołano żadnego niezależnego testu produktu.

Wypróbuj FireAI od HisnLabs za darmo przez 17 dni.

Źródła

  1. SecurityBrief Australia, 2 October 2026: Bitdefender launches AI Guardian beta for Mac agents