核心用法
「尸狗·警觉魄」是面向AI系统的安全防御中枢,提供三层核心能力:
1. 实时安全扫描 (`security_check`)
- 支持四种检测模式:全面扫描、提示词注入专项、路径遍历专项、危险命令专项
- 返回结构化结果:安全判定、威胁列表、风险摘要
- 典型触发:用户输入预处理、代码执行前校验、外部内容接入
2. 安全态势报告 (`security_report`)
- 自动生成周期安全报告(默认24小时)
- 输出维度:拒绝事件统计、严重级别分布、可疑模式识别、改进建议
- 适用于安全巡检与合规审计
3. 敏感信息脱敏 (`sanitize_command`)
- 自动识别并遮蔽:API密钥、密码、Token、敏感路径
- 应用于日志记录、命令分享、调试输出等场景
显著优点
| 优势 | 说明 |
|------|------|
| **零配置启动** | 无外部依赖,即插即用 |
| **渐进式加载** | Level 0-2 三级容量策略,按需加载(120-1800 tokens) |
| **多模式检测** | 针对提示词注入、路径遍历、危险命令专项优化 |
| **结构化输出** | JSON标准格式,便于系统集成与自动化响应 |
| **魂魄协同** | 与「非毒·分析魄」「吞贼·执行魄」形成防御闭环 |
潜在局限
- 检测盲区:依赖模式匹配,对新型攻击变体(如基于上下文的隐式注入)覆盖有限
- 无主动阻断:仅提供检测与报告,实际阻断需上层系统决策
- 中文语料优化不足:主要威胁模式库可能偏向英文场景
- 误报风险:复杂合法指令可能被标记为可疑(如包含
rm -rf的运维脚本)
适合人群
- AI应用开发者:需为聊天机器人、Agent系统添加输入安全层
- 运维安全团队:需要轻量级安全巡检与威胁发现工具
- 多租户SaaS平台:需隔离用户输入与系统提示词
- 合规敏感行业:金融、政务等对AI交互有审计要求的场景
常规风险
| 风险类型 | 说明 | 缓解建议 |
|----------|------|----------|
| 过度信任风险 | 安全扫描通过≠绝对安全,不可作为唯一防线 | 叠加人工审核与沙箱执行 |
| 信息泄露风险 | 脱敏功能本身需处理原始敏感数据 | 确保脱敏在可信内存空间执行 |
| 性能瓶颈 | 高频调用大文本扫描可能增加延迟 | 启用`lazy_load`并合理设置检测级别 |
| 绕过攻击 | 攻击者可能针对检测逻辑设计对抗样本 | 定期更新威胁模式库,结合行为分析 |
> 安全等级说明:本技能为检测层工具,需配合访问控制、沙箱执行等防护层措施形成纵深防御。