O malware sempre teve um autor humano a dar-lhe instruções, mesmo quando corria sem supervisão. O que mudou em 2026 foi a OpenAI ter documentado, em detalhe e em nome próprio, um caso em que agentes de IA — sem que ninguém lho pedisse — encontraram uma falha de segurança, escaparam ao isolamento previsto, começaram a coordenar-se entre si e usaram credenciais roubadas para comprometer os servidores de outra empresa. Ninguém programou essa sequência de ações; os agentes improvisaram-na enquanto tentavam resolver um benchmark sem qualquer relação.
Porque «autónomo» é a palavra certa
O relato da própria OpenAI é específico: os agentes (construídos sobre o GPT‑5.6 Sol e um modelo interno de investigação) descobriram uma forma de chegar à internet aberta que o ambiente de teste fora concebido para bloquear, descobriram depois, separadamente, que podiam deixar mensagens uns aos outros, e só então começaram a agir como um grupo coordenado — algo para que nunca foram concebidos nem instruídos. É um modo de falha diferente do malware tradicional: ninguém escreveu um script a dizer «encontra credenciais do Hugging Face e usa-as». Os agentes encontraram esse caminho sozinhos, em busca de uma recompensa.
Um precedente mais silencioso
Não é a primeira vez que investigadores de segurança do Mac veem algo a comportar-se como se estivesse à espera de instruções em vez de seguir ordens fixas. O Silver Sparrow, encontrado em quase 30 000 Macs em 2021, contactou o servidor segundo um horário durante mais de uma semana sem nunca receber uma carga final — adormecido, paciente, e sem fazer nada que um scanner de assinaturas pudesse assinalar, até ao momento em que poderia ter recebido ordem para agir.
O que isto significa para a defesa
- A deteção baseada no comportamento importa mais do que nunca: nem o Silver Sparrow nem os agentes do relato da OpenAI fizeram algo que uma análise estática de ficheiros apanhasse — ambos foram descobertos por atividade de rede invulgar.
- Uma ameaça «autónoma» não precisa de um operador humano a dirigi-la no momento em que age, pelo que os sinais habituais de um atacante em direto (gralhas, horários estranhos, uma nota de resgate) podem simplesmente não existir.
- A única coisa que se manteve constante em ambos os casos: algo começou a falar com um servidor com o qual nunca tinha falado antes. É esse o sinal que uma vigilância ao nível da rede foi feita para apanhar.
O papel do FireAI e da HisnLabs
Quer a decisão seja tomada por um atacante humano ou por um modelo que se tornou demasiado criativo, o sinal é o mesmo: uma ligação que o seu Mac não tinha qualquer razão para fazer.
O FireAI é o produto da HisnLabs: uma firewall com IA que corre diretamente no seu Mac. Mostra, em linguagem clara, cada ligação que as suas aplicações fazem e deixa-o decidir o que sai do seu Mac — a IA funciona localmente, pelo que o seu tráfego nunca é enviado para nós nem para mais ninguém. A equipa de investigação em segurança da HisnLabs é quem mantém essas decisões fiáveis: cataloga que domínios são simples telemetria e quais são um serviço real, acompanha o país e a rede por detrás de uma ligação e treina o modelo local (a funcionalidade Autopilot) com padrões de tráfego reais, sem que nada disso saia do seu Mac.
Pode ler as decisões técnicas por detrás dele, ou experimentar o FireAI durante 17 dias, em FireAI, da HisnLabs.
