flaw0

🛡️ AI Agent 实时安全守护盾

MoltGuard 为 AI Agent 提供实时防护,检测提示注入、数据外泄和恶意命令,支持本地与企业级部署

收藏
12.5k
安装
2.6k
版本
6.8.20
CLS 安全性认证2026-08-03
点击查看完整报告 >

使用说明

核心功能

MoltGuard 是一款面向 AI Agent 生态的安全防护插件,构建于 OpenClaw 框架之上,通过与 Core 安全引擎联动实现多层威胁检测。

核心防护能力

  • 提示/指令风险检测:识别隐藏于邮件、网页、文档中的提示注入攻击,拦截越权任务指令
  • 行为风险监控:阻断危险命令执行、敏感文件删除、高风险 API 调用
  • 数据泄露防护:防止密钥、PII 等敏感信息意外外泄至 LLM 或第三方服务

技术亮点

采用「意图-行动不匹配检测」技术,捕捉 Agent 言行不一的异常行为模式,弥补传统规则引擎的盲区。

部署与使用

安装后即刻生效,提供 500 次/日免费检测额度。支持三种使用模式:
1. 自动模式:零配置开箱即用

2. 账户绑定:多设备共享配额

3. 企业私有部署:对接自托管 Core 实例

定价策略

免费版满足个人开发者基础需求;付费阶梯($19-$199/月)覆盖从初创团队到大型企业的规模化场景;企业版支持定制配额与私有化部署。

显著优点

  • 检测维度全面,覆盖输入、行为、数据三大攻击面
  • 架构灵活,公有云/私有化/混合部署均支持
  • 与 OpenClaw 生态深度集成,安装卸载便捷

潜在局限

  • 重度依赖 Core 云端服务,断网或延迟可能影响检测时效
  • 免费额度仅 500 次/日,高频场景需付费升级
  • 企业级功能文档较简略,实际部署需官方支持

适合人群

AI Agent 开发者、企业 IT 安全团队、使用 OpenClaw/Claude Code 等工具链的工程师,以及对提示注入和数据合规有强需求的研究机构。

常规风险

  • 检测机制基于启发式与云端模型,存在误报/漏报可能
  • API 密钥本地存储,需关注文件系统权限配置
  • 企业私有部署的网络配置复杂度未充分披露

安全解读

核心用法

MoltGuard是OpenClaw生态中的安全保护插件,主要服务于AI Agent的安全防护场景。用户通过openclaw plugins install @openguardrails/moltguard命令完成安装后,即可获得即时生效的三层安全防护:提示/指令风险检测(识别提示注入、恶意邮件/网页指令、未授权任务)、行为风险拦截(阻止危险命令、文件删除、高风险API调用)以及数据风险防护(防止密钥泄露、PII暴露、敏感数据传输至LLM)。

插件提供完整的命令行管理界面,包括/og_status查看API密钥和配额使用、/og_core进入账户管理门户、/og_claim关联多设备共享配额、/og_config配置API密钥以及/og_dashboard启动本地监控面板。安装后系统会自动分配500次/日的免费检测额度,并支持从个人免费版到企业定制版的五级付费方案。

显著优点

零代码纯文档架构是该Skill最突出的安全特性。作为纯Markdown文档型工具,MoltGuard不依赖任何可执行代码、第三方依赖包或运行时脚本,从根本上消除了代码注入、依赖混淆和供应链攻击的风险。六维安全扫描(静态代码分析、动态行为分析、依赖审计、网络流量分析、隐私合规、威胁情报)全部获得满分或接近满分评价。

来源可信度极高是第二大优势。项目由GitHub组织账号openguardrails维护,采用MIT-0开源许可证,维护者thomaslwang公开了联系方式,项目目标明确聚焦于AI Agent安全防护领域。T2级来源可信度评级(可信组织/GitHub组织账号)配合S+安全等级,使其成为企业级部署的可靠选择。

企业级部署灵活支持从个人免费使用到私有Core部署的完整链路。通过enterprise-enroll.mjs脚本可无缝切换至企业内部Core实例,满足金融、医疗等强合规行业的数据本地化要求。

潜在缺点与局限性

功能边界需明确认知:MoltGuard本身是纯文档型配置工具,实际安全检测能力由后端Core服务提供。这意味着防护效果的持续性完全依赖Core服务的可用性和更新频率,若Core服务中断或规则库滞后,前端代理将失去实时保护能力。

免费额度限制明显:500次/日的检测配额对于高频交互场景(如自动化客服、大规模数据处理)可能迅速耗尽,用户需实时监控/og_status或在关键任务前确认配额状态,否则存在防护真空期风险。

企业部署复杂度:私有Core部署需要Node.js环境执行注册脚本,且涉及API密钥和Agent ID的管理链路,对非技术背景的终端用户存在上手门槛。此外,企业Core的HTTPS证书配置和访问权限管控需要额外的IT安全团队介入。

适合的目标群体

AI Agent开发者与运维团队是核心用户群,尤其适合使用OpenClaw/Claude Code生态构建自动化工作流的工程师。需要防护提示注入攻击的内容审核场景、处理敏感PII数据的客服系统、以及执行文件操作和API调用的RPA流程均为典型应用场域。

企业安全合规团队同样高度相关,特别是需要满足GDPR/CCPA数据保护法规、实施零信任架构或部署私有AI基础设施的金融、医疗、政务机构。S+安全等级和纯文档架构使其通过内部安全审计的阻力极低。

个人高级用户亦可受益,免费额度足以覆盖日常AI辅助编程、文档处理等中度使用场景,作为基础安全防护层降低误操作风险。

使用风险与注意事项

服务依赖风险:由于实际检测逻辑在Core服务端执行,网络连通性故障或Core服务维护将直接导致防护失效。建议在关键系统中配置备用安全策略,避免单一依赖。

配额管理风险:免费用户需建立配额监控机制,超额后未升级付费计划将使Agent暴露于未检测风险中。企业用户应通过/og_claim实现多设备配额共享,避免单点配额耗尽。

企业部署配置风险enterprise-enroll.mjs脚本修改的Core地址配置若被篡改,可能导致流量劫持至恶意节点。建议对企业配置文件实施完整性监控(如SHA256校验)和访问权限管控(仅限root/admin只读)。

误报与漏报平衡:与所有安全工具类似,MoltGuard的规则集可能在过度严格(阻断正常业务流程)与过度宽松(放过新型攻击向量)之间需要持续调优。建议在正式上线前使用样本文件(如test-email-popup.txt)验证检测灵敏度,并根据业务特征向Core反馈规则优化建议。

flaw0 内容

手动下载zip · 3.3 kB
skill-card.mdtext/markdown
请选择文件