autoresearch

🛡️ AI Agent 安全护栏,防注入防泄密

开源AI安全护栏工具,专注防御提示注入、数据泄露和恶意命令,每日500次免费检测额度。

收藏
8.3k
安装
3.3k
版本
1.0.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

MoltGuard 是一款面向 AI Agent 的安全防护插件,通过 OpenClaw 平台安装后即可生效。主要功能包括:

1. 实时威胁检测:读取文件、邮件或网页内容时自动扫描隐藏的提示注入攻击
2. 三层风险防护:覆盖 Prompt/Instruction Risk(提示注入、恶意指令)、Behavioral Risk(危险命令、文件删除)、Data Risk(密钥泄露、PII 暴露)

3. 云端核心处理:所有检测由 Core 服务端执行,采用"意图-行为不匹配检测"技术

4. 企业级部署:支持私有 Core 部署,通过 enrollment 脚本切换至企业后端

安装与配置

  • 一键安装:openclaw plugins install @openguardrails/moltguard
  • 自动获取 500 次/日免费额度
  • 支持 Agent 认领机制,多设备共享账户配额
  • 提供本地 Dashboard 可视化监控

使用限制

  • 免费额度有限(500次/日),高频使用需付费升级
  • 依赖 OpenClaw 平台生态,非独立运行
  • 企业版需联系销售,无公开定价

显著优点

  • 零配置启动:安装即生效,无需手动调参
  • 多场景覆盖:文件、邮件、网页内容全渠道防护
  • 意图识别技术:不依赖黑名单,通过行为模式识别攻击
  • 灵活计费:从个人免费到企业定制,阶梯清晰

潜在局限

  • 生态锁定:深度绑定 OpenClaw,迁移成本未知
  • 透明度不足:检测规则未开源,依赖 Core 云端黑盒
  • 网络依赖:所有检测需联网,离线场景无法使用
  • 误报风险:意图识别可能产生误判,影响正常任务

适合人群

  • 高频使用 AI Agent 处理外部内容的个人开发者
  • 需要统一安全策略的中小型团队(Starter/Business 档)
  • 有合规要求、需私有部署的大型企业

常规风险

  • 数据外泄:文件内容需上传至 Core 分析,敏感数据存在第三方暴露风险
  • 服务中断:配额耗尽或网络故障将导致防护失效
  • 供应链攻击:插件更新机制若被攻破,可植入恶意代码
  • 过度依赖:用户可能因"已安装护栏"而降低警惕,产生虚假安全感

autoresearch 内容

手动下载zip · 2.2 kB
SKILL.mdtext/markdown
请选择文件