核心功能
SlowMist Agent Security 是一套面向 AI Agent 对抗环境的全方位安全审查框架,由知名区块链安全公司慢雾科技(SlowMist)开发。该框架将 "所有外部输入均不可信" 作为核心原则,系统性地解决了 AI Agent 在处理外部内容时的安全风险问题。
覆盖场景
框架激活条件涵盖六大高风险场景:
- Skill/MCP 安装:审查 npm/pip/cargo 等包管理依赖
- GitHub 仓库评估:代码库安全分析与依赖审查
- URL/文档审查:外部链接、Gist、Markdown 文件内容安全
- 链上交互:地址、合约、DApp 的 AML 风险评估
- 产品服务评估:API、SDK 的权限与数据流审查
- 社交分享验证:群聊、频道中推荐工具的安全性
核心机制
四级风险评级:🟢 LOW / 🟡 MEDIUM / 🔴 HIGH / ⛔ REJECT,其中 HIGH 和 REJECT 级别必须经人工审批方可执行。
五级信任层级:从官方组织到未知来源,逐级提升审查强度,但绝不跳过任何验证步骤。
三大模式库:整合 11 类代码危险模式、8 类社会工程攻击、7 类供应链攻击特征。
显著优点
1. 实战驱动:基于真实攻击案例与事件响应经验构建,非理论推演
2. 场景完整:覆盖 AI Agent 几乎所有外部输入攻击面
3. 标准化输出:强制使用统一报告模板,避免自由发挥导致的信息遗漏
4. 渐进信任机制:避免一次性授权风险,支持动态调整信任等级
5. 人机协同:高风险操作强制人工决策,平衡自动化效率与安全性
局限性与风险
1. 依赖外部工具:链上 AML 评估需依赖 MistTrack 等可选集成
2. 人工瓶颈:HIGH/REJECT 级别强制人工审批,可能降低自动化效率
3. 误报成本:"宁可误报、不可漏报" 原则可能导致正常服务被过度拦截
4. 更新滞后:攻击模式库需持续维护以应对新型威胁
适合人群
- AI Agent 开发者与运维团队
- 加密货币/Web3 领域用户(链上地址审查为核心场景)
- 企业级 AI 系统安全架构师
- 对供应链攻击、提示词注入等威胁高度敏感的安全意识用户
常规风险
框架本身仅提供审查方法论与模板,不直接执行代码扫描或漏洞利用检测。最终安全效果取决于使用者对审查流程的严格遵循程度,以及外部集成工具(如 MistTrack)的可用性与准确性。