核心用途
Battle-Tested Agent 是一套面向生产环境的 AI 代理强化框架,提炼出16个经过实战验证的设计模式,覆盖从单代理稳定性到多智能体编排的完整可靠性栈。
核心用法
三层渐进式加固:
| 层级 | 模式数量 | 适用场景 |
|:---|:---|:---|
| **Starter** | 5个 | 所有代理的基础可靠性(WAL协议、反幻觉、歧义拦截、简化优先、阻塞处理) |
| **Intermediate** | 5个 | 日常高频任务(验证门、工作缓冲区、QA门禁、决策日志、实现验证) |
| **Advanced** | 6个 | 多代理编排与长期运行(委托规则、五点交接、任务状态追踪、压缩加固、递归监控、自我改进) |
关键工作流:
1. 审计先行 — 运行 audit.sh 扫描工作空间,识别缺失模式
2. 按需分级 — 避免过度工程,只植入实际失败模式对应的机制
3. 机制优于措辞 — 用验证门禁替代"务必检查"的软性提示
显著优点
- 实战血统:每个模式均来自真实故障,非理论推导
- 冲突裁决明确:安全模式优先于速度模式,证据模式优先于行动模式
- 轻量可裁剪:模板化资产,支持渐进式采用
- 多平台兼容:OpenClaw、Claude Code、Cowork 及任何 SKILL.md 体系
局限与风险
| 风险类型 | 说明 |
|:---|:---|
| **适用范围限制** | 不适用于一次性提示调优、角色设定或工具扩展场景 |
| **组织摩擦** | "机制优于措辞"原则可能与偏好自然语言约束的团队冲突 |
| **审计依赖** | 未运行审计脚本时,模式覆盖盲区难以肉眼识别 |
| **多代理复杂性** | 高级模式(委托/交接/编排)引入协调成本,简单场景可能过度设计 |
适合人群
- 构建长期自主运行或高频重复调用代理的开发者
- 遭遇上下文压缩丢失、幻觉报告、交接丢单等具体故障的团队
- 需要预发布检查清单或代理可靠性评审的技术负责人
使用建议
优先采用「信任链」「交接环」「生存包」「质量门」四大模式组合,而非孤立套用单点方案。