SecurityBrief Australia ha riferito il 2 ottobre 2026 che Bitdefender ha lanciato AI Guardian, uno strumento di sicurezza per agenti IA autonomi, come beta pubblica gratuita per macOS [1]. Lo strumento si rivolge a sviluppatori, professionisti tecnici e altri utenti che si affidano ad agenti IA per accedere per loro conto a strumenti, file e credenziali [1]. La versione iniziale supporta due agenti, Claude Code e OpenClaw.
Contesto
Agenti IA di questo tipo eseguono comandi, leggono file e richiamano strumenti sul computer di chi li usa. L’articolo descrive il prodotto come un mezzo per dare agli utenti più controllo su ciò che questi agenti possono fare e per fermare le azioni non sicure prima che avvengano [1]. Cita una ricerca indipendente che ha testato 20 dei principali agenti IA contro oltre 1.300 tentativi di tool poisoning, rilevando un tasso medio di successo degli attacchi del 36,5 per cento, con un modello manipolato nel 72,8 per cento dei casi [1].
Cosa descrive il resoconto
Secondo SecurityBrief, AI Guardian funziona in tre fasi: stabilisce una policy di base per strumenti, file e azioni consentiti, confronta in tempo reale ogni azione tentata con quella base e restituisce un verdetto (consentire, segnalare o bloccare) prima che l’azione proceda. Tutte le decisioni vengono registrate in un log verificabile [1].
L’articolo elenca come ambito di copertura il rilevamento e il blocco dei tentativi di prompt injection, l’ispezione degli strumenti del Model Context Protocol, la convalida delle skill degli agenti prima dell’esecuzione e il controllo dell’accesso a chiavi di interfacce di programmazione (API) esposte, chiavi SSH e credenziali di sistema [1]. L’analisi dei prompt avviene sul dispositivo, e alcuni controlli usano i servizi cloud di Bitdefender [1].
Le versioni supportate sono Claude Code 2.1.121 o successive e OpenClaw 2026.6.6 o successive. La versione è solo per macOS, senza tempistiche indicate per altri sistemi operativi, ed è disponibile solo in inglese [1]. Il vicepresidente senior di Bitdefender Ciprian Istrate è citato mentre afferma che gli agenti IA stanno diventando un’estensione diretta degli utenti che li usano, ereditandone gli stessi rischi di sicurezza [1].
Implicazioni per chi usa un Mac
Il resoconto descrive un controllo posto tra un agente e le azioni che compie sul Mac. Si applica a due agenti specifici su macOS e, secondo l’articolo, non copre altri agenti né altri sistemi operativi [1]. Chi usa un agente diverso, o una versione precedente di uno dei due, è fuori dall’ambito dichiarato.
I dati sul tool poisoning e sui segreti esposti provengono dalla ricerca citata dall’articolo, non da un test di AI Guardian. L’articolo, nella versione consultata, non riporta quanto efficacemente il prodotto blocchi gli attacchi che descrive [1].
Raccomandazioni
- Verificare che l’agente installato rientri nelle versioni supportate prima di fare affidamento su un controllo lato agente: Claude Code 2.1.121 o successive e OpenClaw 2026.6.6 o successive [1].
- Trattare una beta come una beta: leggere che cosa registra lo strumento e dove i suoi controlli cloud inviano i dati, dato che l’articolo afferma che alcuni controlli usano i servizi cloud di Bitdefender [1].
- Tenere, quando possibile, le chiavi API e le chiavi SSH fuori dalle cartelle in cui lavora un agente, poiché l’accesso alle credenziali è uno dei rischi elencati [1].
- Rivedere gli strumenti del Model Context Protocol e le skill degli agenti installati, e rimuovere quelli non necessari.
Rilevanza per FireAI
FireAI e il prodotto descritto agiscono a livelli diversi. Secondo la descrizione, AI Guardian valuta l’azione di un agente, come l’uso di uno strumento o la lettura di un file. FireAI è un firewall per un singolo Mac: identifica un’app tramite la firma del codice o il percorso, mostra le connessioni che l’app apre e vi applica le regole per app. Su un Mac che esegue un agente, questo compare in FireAI come il programma che lo avvia, quindi una regola si applica a tutto ciò che quel programma esegue, e la pagina Attività elenca le destinazioni contattate.
FireAI non legge le istruzioni date a un agente, non rileva la prompt injection, non ispeziona gli strumenti del Model Context Protocol né le skill degli agenti e non legge l’interno di una connessione cifrata. Non impedisce a un agente di leggere o eliminare file locali e non controlla quali chiavi un programma possa aprire. Non offre un’integrazione né con Claude Code né con OpenClaw; ne vede soltanto le connessioni di rete.
Limiti
Questa notizia si basa su un unico articolo di settore. L’annuncio di Bitdefender non è stato reperito, quindi i dettagli del prodotto sono quelli riportati da SecurityBrief, e l’articolo non contiene link a una pagina di Bitdefender [1]. I dati della ricerca sono citati dall’articolo senza indicare uno studio preciso e qui non sono stati verificati. Non è citato alcun test indipendente del prodotto.
Prova FireAI, di HisnLabs gratis per 17 giorni.