SlowMist Agent Security

🛡️ AI Agent 安全审查框架

SlowMist 出品的 AI Agent 安全审查框架,覆盖 Skill/MCP 安装、GitHub 仓库、链上地址等 6 大场景,源自真实攻击案例与事件响应经验。

收藏
8.6k
安装
2k
版本
0.1.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心功能

SlowMist Agent Security 是一套面向 AI Agent 对抗环境的全方位安全审查框架,由知名区块链安全公司慢雾科技(SlowMist)开发。该框架将 "所有外部输入均不可信" 作为核心原则,系统性地解决了 AI Agent 在处理外部内容时的安全风险问题。

覆盖场景

框架激活条件涵盖六大高风险场景:

  • Skill/MCP 安装:审查 npm/pip/cargo 等包管理依赖
  • GitHub 仓库评估:代码库安全分析与依赖审查
  • URL/文档审查:外部链接、Gist、Markdown 文件内容安全
  • 链上交互:地址、合约、DApp 的 AML 风险评估
  • 产品服务评估:API、SDK 的权限与数据流审查
  • 社交分享验证:群聊、频道中推荐工具的安全性

核心机制

四级风险评级:🟢 LOW / 🟡 MEDIUM / 🔴 HIGH / ⛔ REJECT,其中 HIGH 和 REJECT 级别必须经人工审批方可执行。

五级信任层级:从官方组织到未知来源,逐级提升审查强度,但绝不跳过任何验证步骤。

三大模式库:整合 11 类代码危险模式、8 类社会工程攻击、7 类供应链攻击特征。

显著优点

1. 实战驱动:基于真实攻击案例与事件响应经验构建,非理论推演
2. 场景完整:覆盖 AI Agent 几乎所有外部输入攻击面

3. 标准化输出:强制使用统一报告模板,避免自由发挥导致的信息遗漏

4. 渐进信任机制:避免一次性授权风险,支持动态调整信任等级

5. 人机协同:高风险操作强制人工决策,平衡自动化效率与安全性

局限性与风险

1. 依赖外部工具:链上 AML 评估需依赖 MistTrack 等可选集成
2. 人工瓶颈:HIGH/REJECT 级别强制人工审批,可能降低自动化效率

3. 误报成本:"宁可误报、不可漏报" 原则可能导致正常服务被过度拦截

4. 更新滞后:攻击模式库需持续维护以应对新型威胁

适合人群

  • AI Agent 开发者与运维团队
  • 加密货币/Web3 领域用户(链上地址审查为核心场景)
  • 企业级 AI 系统安全架构师
  • 对供应链攻击、提示词注入等威胁高度敏感的安全意识用户

常规风险

框架本身仅提供审查方法论与模板,不直接执行代码扫描或漏洞利用检测。最终安全效果取决于使用者对审查流程的严格遵循程度,以及外部集成工具(如 MistTrack)的可用性与准确性。

SlowMist Agent Security 内容

patterns文件夹
reviews文件夹
templates文件夹
手动下载zip · 33.3 kB
red-flags.mdtext/markdown
请选择文件