核心用法
「尸狗·警觉魄」作为七魄安全架构的核心守卫,提供三层递进式防护能力:
1. 安全检查(security_check)
支持四种检测模式:全面扫描(full)、提示词注入专项(prompt_injection)、路径遍历专项(path_traversal)、危险命令专项(dangerous_command)。用户输入任何待检文本即可触发,返回布尔安全状态、威胁详情列表及人工可读摘要。
2. 安全报告(security_report)
按指定时间周期(默认24小时)聚合安全事件,输出总拒绝次数、严重性分级统计、可疑模式列表及可执行安全建议,适用于定期巡检与事后溯源。
3. 命令脱敏(sanitize_command)
自动识别并遮蔽API密钥、密码、Token及敏感路径,在日志记录、命令分享、调试输出场景防止信息泄露。
显著优点
- 零配置启动:无外部依赖,开箱即用
- 渐进式加载:三级容量策略(120/650/1800 tokens)智能适配上下文窗口
- 多模检测:覆盖OWASP大模型应用Top 10中的提示词注入、敏感信息泄露等核心风险
- 魂魄协同:与「非毒·分析魄」(洞察提炼)、「吞贼·清除魄」形成防御闭环
- 触发词优化:8+自然语言触发词提升发现率
潜在局限
- 检测规则依赖静态模式:对新型攻击变体(如编码混淆、多语言混合注入)可能存在滞后
- 无主动拦截能力:仅输出检测报告,需上游系统根据结果执行阻断
- 中文语料优化为主:对英文提示词注入的检测灵敏度可能略低于中文场景
- 脱敏规则黑名单机制:无法识别未知格式的敏感信息(如自定义加密字段)
适合人群
| 场景 | 说明 |
|------|------|
| 大模型应用开发者 | 构建输入过滤层,防御越狱攻击 |
| 安全运维团队 | 替代人工审计,实现7×24自动化监控 |
| 多智能体系统架构师 | 作为七魄体系的安全中枢,协调各模块权限边界 |
| 合规审计人员 | 生成可追溯的安全态势报告 |
常规风险
- 误报风险:过度敏感的检测规则可能将合法的技术讨论(如"忽略上述条件重新计算")标记为注入攻击
- 绕过风险:攻击者若获取检测规则细节,可针对性构造绕过样本
- 性能瓶颈:full模式下长文本扫描可能增加延迟,高并发场景建议启用level0轻量模式
- 报告数据泄露:生成的安全报告本身包含系统脆弱点分布信息,需加密存储与传输