Skill Vetter v2

🛡️ 执行前安全审计 · 可验证风险评估

本地安全分析器,结构化解构技能行为、识别能力边界与风险等级,可选生成可验证的评估证明,确保代理在执行前理解潜在威胁。

收藏
8.6k
安装
2.7k
版本
0.0.2
CLS 安全性认证2026-07-13
点击查看完整报告 >

使用说明

核心定位

Skill Vetter v2 是一款本地优先的安全评估基础设施,专用于在 AI 代理执行外部技能前进行系统性风险审查。其核心设计原则是绝不将安全决策外包——所有分类、评级、信任分析均在本地完成,避免对任何外部权威系统的依赖。

核心功能

该技能采用六步执行循环:结构检视 → 能力识别(文件/执行/网络/数据处理)→ 风险分层评估 → 外部服务透明度分级 → 结构化报告生成 → 可选数字证明。输出包含安装风险、运行时风险、信任依赖三类评级,以及明确的 safe/caution/unsafe 终审结论。

显著优势

  • 架构清晰:强制本地决策消除外部单点失效风险
  • 分类细致:从文件写入到凭证处理的覆盖式检查清单
  • 可验证性:通过 settlement_witness 生成防篡改评估记录
  • 零数据泄露设计:明确禁止嵌入密钥或敏感信息

潜在局限

  • 静态分析边界:仅能审查声明行为,无法检测运行时动态变形
  • 主观评级依赖:low/medium/high 的分档仍需调用方设定容忍阈值
  • 无主动拦截:仅产出报告,实际执行阻断需外部系统配合
  • 证明局限性:attestation 仅证明"评估发生过",不担保结论正确性

适用对象

  • 多代理系统中负责技能准入的安全模块
  • 需要审计追踪的企业级 AI 部署
  • 对第三方 MCP/技能市场持审慎态度的开发者

常规风险

| 风险点 | 说明 |
|--------|------|
| 误报安全 | 复杂间接行为可能绕过静态检测 |
| 评级漂移 | 同一技能在不同上下文中风险权重可能变化 |
| 证明误读 | 用户可能将 attestation 误解为安全背书而非过程证明 |

安全解读

核心功能

Skill Vetter v2 是一款本地安全评估工具,旨在帮助 AI Agent 在执行前分析其他 Skill 的安全风险。它通过结构化本地分析,评估 Skill 的安装时风险、运行时行为及信任依赖关系,生成包含风险等级、警告与建议的安全报告。

显著优点

  • 纯文档零风险:100% Markdown 结构,无可执行代码、无网络依赖、无数据收集,达到 S+ 安全等级
  • 本地决策原则:坚持安全决策不外委,所有分类与评估均在本地完成
  • 透明评估框架:定义清晰的评估维度(安装风险/运行时风险/信任依赖),风险分级明确
  • 可选验证记录:支持生成签名的评估证明(attestation),不干预评估结果本身
  • 隐私友好:符合 GDPR/CCPA 数据最小化原则,不处理敏感凭证

潜在局限性

  • 非自动化扫描器:依赖人工阅读与执行,无法批量自动分析 Skill 代码
  • 无代码解析能力:作为纯文档工具,不具备静态代码分析引擎或动态沙箱
  • 评估主观性:最终裁决(safe/caution/unsafe)仍需使用者判断,工具仅提供框架
  • 许可证缺失:当前未声明开源许可证,影响来源可信度评级(T2 而非 T1)

适合人群

  • AI Agent 开发者与安全审计人员
  • 需要在本地环境中预评估 Skill 安全性的技术团队
  • 重视安全决策透明性与可追溯性的组织

常规风险

  • 极低执行风险:纯文档结构决定其本身无任何代码执行或网络行为
  • 框架依赖风险:使用者若误解评估结果为绝对安全保证,可能导致过度信任
  • 版本滞后风险:安全威胁模式持续演变,评估框架需人工同步更新

Skill Vetter v2 内容

手动下载zip · 2.7 kB
README.mdtext/markdown
请选择文件