核心用法
Agent Hardening 是一款专为 OpenClaw 智能体设计的安全审计工具,采用完全只读的设计理念,在不修改任何系统文件的前提下执行五项关键安全检查:
1. Unicode 注入扫描:检测内存文件中的零宽字符(U+200C、U+200D、U+2060、U+2063、U+FEFF),这类不可见字符常被用于绕过内容过滤或执行隐藏指令攻击
2. 输入净化验证:通过 Python 脚本测试 unicodedata 过滤机制,验证格式控制字符(Cf 类别)是否被正确移除
3. 工具权限审查:读取 OpenClaw 配置文件,排查 exec、elevated 等高危工具权限配置
4. Fetch 策略审计:扫描内存中网络请求工具(web_fetch、curl、wget)的使用痕迹
5. 威胁定义比对:关联社区维护的已知攻击模式数据库
显著优点
- 零侵入保障:所有检查均为只读操作,绝不创建、修改或删除文件,适合生产环境安全扫描
- 精准攻击向量覆盖:针对智能体特有的 Unicode 视觉欺骗攻击(同形异义字、零宽字符)提供专项检测
- 开源生态支持:威胁定义库由社区持续更新,保持对新攻击手法的感知能力
- 轻量快速:基于 shell 和 Python 标准库,无额外依赖
潜在缺点与局限性
- 被动检测:仅识别已存在的风险痕迹,无法主动拦截实时攻击
- 配置依赖:Tool Permission Review 需正确读取
~/.openclaw/config.yaml,若路径自定义或权限受限则结果不完整 - 误报可能:Unicode 字符的合法使用(如右-to-left标记用于阿拉伯语)可能被标记需人工复核
- 威胁库时效性:社区维护的 GitHub 仓库更新频率不确定,零日攻击可能滞后
适合人群
- OpenClaw/Claude Code 等智能体框架的运维人员
- 企业 AI 安全合规团队
- 处理不可信用户输入的智能体开发者
- 需要对智能体进行定期安全体检的红队/蓝队人员
常规风险
- 信息泄露:扫描结果可能暴露系统路径、配置结构等敏感信息,建议在隔离环境查看
- 权限提升试探:虽然工具本身只读,但攻击者可能伪造审计结果诱导用户执行后续"修复"操作
- 供应链风险:威胁定义库来自第三方 GitHub 仓库,需验证 commit 签名或 pinning 特定版本