Então você instalou o OpenClaw
O OpenClaw se torna poderoso no momento em que consegue conectar um modelo a ferramentas, habilidades, servidores MCP e um espaço de trabalho ativo. É também nesse momento que a segurança deixa de ser opcional.
Se você está avaliando o OpenClaw ou planejando executá-lo diante de ferramentas e dados reais, a primeira pergunta não deve ser apenas o que o agente pode fazer. A primeira pergunta deveria ser o que acontece se confiar no componente errado.
O que o OpenClaw realmente muda
O OpenClaw é útil porque ajuda os agentes de IA a fazer mais do que responder a solicitações isoladas.

Pode:
- Conecte-se às habilidades
- Use servidores MCP
- Ferramentas e serviços de chamada
- Trabalhar com arquivos e um espaço de trabalho
- Gere código que chega ao ambiente
Isso torna o OpenClaw mais capaz.
Também cria mais limites de confiança.
Quando um agente pode instalar auxiliares, chamar ferramentas externas e atuar em um espaço de trabalho ativo, o risco não está mais limitado à geração incorreta de textos. Agora o sistema precisa decidir o que é confiável, o que é executado, o que chega ao modelo e qual código é escrito no ambiente.
Por que a segurança do OpenClaw é importante
Esta não é apenas uma preocupação hipotética de design.

A auditoria da Koi Safety de 2.857 habilidades do ClawHub encontrou 341 entradas maliciosas, ou 11,9%.
Um estudo arXiv publicado descobriu que 26,1% das competências analisadas apresentavam pelo menos uma vulnerabilidade. O mesmo estudo relatou 13,3% com padrões de exfiltração de dados e 11,8% com padrões de escalonamento de privilégios.
Esses números não significam que todas as habilidades do OpenClaw sejam maliciosas.
Eles significam algo mais prático: já existe comportamento arriscado suficiente no ecossistema para que o OpenClaw não deva ser executado sem controles de segurança à sua frente.
Uma habilidade ruim com permissões de leitura de arquivos e um espaço de trabalho ativo pode ser suficiente para expor dados, executar comandos arriscados ou danificar o ambiente. Leia mais estatísticas sobre isso página de visão geral.
O que DefenseClaw oferece


DefesaClaw é gratuito, de código aberto solução de segurança para OpenClaw.
Ele adiciona verificações antes da instalação e enquanto o sistema está em execução. Ele fornece proteção por meio de quatro áreas/motores de capacidade:
- Guardrails – inspeciona prompts e modela o tráfego para detectar injeção de immediate, solicitações inseguras e exposição de dados confidenciais antes que o modelo atue sobre eles
- Inspeção de ferramentas – verifica habilidades, servidores MCP e chamadas de ferramentas em busca de comportamentos de risco, como acesso secreto, comandos inseguros e acesso ao sistema interno
- Instalar verificação – verifica habilidades, servidores MCP e plug-ins antes que sejam confiáveis, para que componentes maliciosos ou inseguros possam ser bloqueados antecipadamente
- CodeGuard – analisa o código gerado por IA em busca de padrões perigosos, como execução de comandos, segredos incorporados e consultas inseguras antes de ser escrito ou executado


Se você quiser ver detalhes técnicos, você pode revisar o diagrama completo.
O demonstração ao vivo tem exemplos que explicam o que cada mecanismo faz.
1. Guarda-corpos
O fluxo de proteção mostra como prompts arriscados e conteúdo envenenado podem alterar o comportamento do modelo quando ele estiver conectado a um fluxo de trabalho actual.


Na demonstração, uma nota envenenada ou uma solicitação de estilo de privacidade empurra o modelo para um caminho inseguro. O DefenseClaw inspeciona esse tráfego e bloqueia o resultado inseguro antes que ele alcance o caminho do modelo protegido.
2. Inspeção de ferramentas
A seção MCP é uma das partes mais claras do passo a passo.
Mostra como um caminho MCP malicioso pode tentar:
- leia credenciais sintéticas da AWS
- execute um comando de host
- buscar configuração interna
No caminho protegido, essas solicitações de ferramentas são bloqueadas pela política antes de atingirem o resultado last da ferramenta.
3. Instale a verificação
A segurança tem que começar antes da confiança.
A demonstração mostra o que acontece quando o OpenClaw é solicitado a aceitar:
- uma habilidade maliciosa
- um servidor MCP inseguro
O DefenseClaw verifica esses componentes antes que sejam confiáveis e pode rejeitá-los ou colocá-los em quarentena antes que se tornem parte do fluxo de trabalho.
4. CódigoGuarda
O caminho last concentra-se no código escrito pelo agente.
Isso é importante porque mesmo quando um immediate ou chamada de ferramenta parece inofensivo, a próxima etapa pode ser a geração de código que chega ao espaço de trabalho.
A demonstração torna isso concreto com exemplos como:
- execução de shell
- materials de chave privada incorporada
- construção SQL insegura
O DefenseClaw verifica esses padrões antes que a gravação do arquivo chegue.
Laboratório de segurança OpenClaw


O laboratório de segurança OpenClaw é um passo a passo prático onde você configura seu próprio ambiente OpenClaw, testa habilidades maliciosas, servidores MCP inseguros, ataques imediatos e caminhos de código arriscados e, em seguida, aplica o DefenseClaw para inspecioná-los ou bloqueá-los antes que causem danos.
Você também pode usá-lo como referência de práticas recomendadas para implantar o DefenseClaw e proteger seu próprio ambiente.
Comece o laboratório aqui: Laboratório prático OpenClaw Safety
Se quiser mais, experimente todos os laboratórios práticos da Jornada de aprendizagem de segurança de IA em cs.co/aj.
Divirta-se explorando os laboratórios e sinta-se à vontade para entrar em contato se tiver dúvidas ou comentários.