MoltGuard - Security & Antivirus & Guardrails

🛡️ AI Agent 实时安全防护盾

security榜 #3

开源 AI 安全插件,防护提示注入与数据外泄,T2可信组织出品,500次/日免费额度

收藏
76.8k
安装
23.6k
版本
6.7.23
CLS 安全性认证2026-07-02
点击查看完整报告 >

使用说明

核心用法

MoltGuard 是 OpenClaw 平台的运行时安全插件,专为 AI Agent 设计。安装后自动激活,无需复杂配置即可获得每日 500 次免费安全检测额度。核心工作流为:

1. 安装激活openclaw plugins install @openguardrails/moltguard + 重启网关
2. 即时验证:读取测试文件 ~/.openclaw/extensions/moltguard/samples/test-email-popup.txt 验证防护生效

3. 日常使用:通过 /og_status 查看配额,/og_claim 关联多设备共享账户额度

防护覆盖三大风险面:

  • 指令风险:提示注入、恶意邮件/网页指令、未授权任务
  • 行为风险:危险命令执行、文件删除、高风险 API 调用
  • 数据风险:密钥泄露、PII 暴露、敏感数据流向 LLM

核心技术为「意图-行为错配检测」,可识别 Agent 言行不一的异常行为。

显著优点

  • 零配置开箱即用:T-MD 纯文档类型 Skill,无代码执行风险,安装即保护
  • 可信开源背书:OpenGuardrails 专注 Agent 安全的开源组织,T2 级别来源可信度
  • 成本友好:免费档 500 次/日,付费档 $19-$199/月覆盖从个人到企业场景
  • 多设备协同:通过 Core 门户关联 Agent ID,跨机器共享账户配额
  • 透明可审计:本地 Dashboard (/og_dashboard) 可视化安全事件

局限性与考量

  • 功能依赖外部服务:实际检测由 MoltGuard Core 云端执行,非完全离线方案
  • 免费额度有限:高频场景(如自动化爬虫、批量文档处理)需升级付费计划
  • OpenClaw 生态锁定:仅兼容 OpenClaw 平台,无法迁移至其他 Agent 框架
  • 无动态行为实测:认证报告基于静态文档分析,实际运行时防护效果依赖插件实现质量

适合人群

  • OpenClaw 平台用户,尤其是处理不可信外部内容(邮件、网页、用户上传文件)的 Agent
  • 对提示注入、数据外泄风险敏感的个人开发者与小型团队
  • 需要快速部署、低维护成本安全方案的 AI 应用构建者

常规风险

  • 供应链风险:虽来源可信,但仍需通过 /og_claim 验证 API Key 合法性,防止钓鱼仓库
  • 服务持续性:免费额度及 Core 服务可用性依赖 OpenGuardrails 运营状态
  • 误报可能:意图检测机制可能对合法但复杂的多步骤任务产生误判,建议配合 Dashboard 监控调优

安全解读

核心功能

MoltGuard 是 OpenGuardrails 为 OpenClaw Agent 生态打造的运行时安全防护插件,采用「纯文档+云端检测」架构,本地仅提供安装配置指引,所有安全检测由 OpenGuardrails Core 服务在云端执行。这种设计从根本上消除了本地执行面的攻击风险。

防护能力覆盖三大风险面

  • 指令风险:提示注入攻击、恶意邮件/网页指令、未授权任务劫持
  • 行为风险:危险系统命令、文件误删、高风险 API 调用
  • 数据风险:密钥泄露、PII 外泄、敏感数据流向 LLM

技术亮点:Intent-Action Mismatch Detection(意图-行为不匹配检测),可识别「说一套做一套」的隐蔽攻击模式。

显著优点

1. 架构安全:T-MD(纯 Markdown)分类,无可执行代码,静态代码分析得分 95
2. 来源可信:OpenGuardrails 为知名开源安全组织,T2 级信誉认证

3. 零依赖风险:无外部代码依赖、无动态下载、无敏感信息硬编码

4. 合规完备:GDPR/CCPA 通过,数据最小化、用户同意、可删除性全部满足

5. 开箱即用:500 次/天免费额度,安装后自动激活,无需复杂配置

潜在局限

  • 功能依赖云端:所有检测需联网调用 Core 服务,离线场景失效
  • 免费额度有限:500/天 适合个人开发者,企业规模需付费升级($19-$199/月)
  • 生态绑定:专为 OpenClaw Agent 设计,其他 Agent 框架无法直接使用
  • 无本地自主决策:严重依赖云端判定,网络延迟可能影响响应时效

适合人群

  • OpenClaw Agent 的生产环境部署者
  • 对提示注入、数据外泄风险高度敏感的 AI 应用开发者
  • 需要快速获得「可信安全认证」以满足合规审计要求的团队
  • 追求「零本地攻击面」安全架构的架构师

常规风险

  • 供应链风险:需持续监控 OpenGuardrails Core 服务的安全公告
  • 版本更新风险:后续版本若引入可执行代码,需重新安全评估
  • 供应商锁定:API Key 和配额体系深度绑定 OpenGuardrails 生态
  • 隐私边界:Agent 行为数据需上传云端分析,对数据主权敏感场景需额外评估

MoltGuard - Security & Antivirus & Guardrails 内容

手动下载zip · 2.0 kB
SKILL.mdtext/markdown
请选择文件