Battle-Tested Agent

⚔️ 16条生产级模式 · 代理可靠性硬通货

16条生产级AI代理强化模式,从记忆管理到多智能体交接,解决幻觉、上下文丢失与系统脆弱性。

收藏
5.2k
安装
1.1k
版本
1.3.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用途

Battle-Tested Agent 是一套面向生产环境的 AI 代理强化框架,提炼出16个经过实战验证的设计模式,覆盖从单代理稳定性到多智能体编排的完整可靠性栈。

核心用法

三层渐进式加固:

| 层级 | 模式数量 | 适用场景 |
|:---|:---|:---|
| **Starter** | 5个 | 所有代理的基础可靠性(WAL协议、反幻觉、歧义拦截、简化优先、阻塞处理) |
| **Intermediate** | 5个 | 日常高频任务(验证门、工作缓冲区、QA门禁、决策日志、实现验证) |
| **Advanced** | 6个 | 多代理编排与长期运行(委托规则、五点交接、任务状态追踪、压缩加固、递归监控、自我改进) |

关键工作流:
1. 审计先行 — 运行 audit.sh 扫描工作空间,识别缺失模式

2. 按需分级 — 避免过度工程,只植入实际失败模式对应的机制

3. 机制优于措辞 — 用验证门禁替代"务必检查"的软性提示

显著优点

  • 实战血统:每个模式均来自真实故障,非理论推导
  • 冲突裁决明确:安全模式优先于速度模式,证据模式优先于行动模式
  • 轻量可裁剪:模板化资产,支持渐进式采用
  • 多平台兼容:OpenClaw、Claude Code、Cowork 及任何 SKILL.md 体系

局限与风险

| 风险类型 | 说明 |
|:---|:---|
| **适用范围限制** | 不适用于一次性提示调优、角色设定或工具扩展场景 |
| **组织摩擦** | "机制优于措辞"原则可能与偏好自然语言约束的团队冲突 |
| **审计依赖** | 未运行审计脚本时,模式覆盖盲区难以肉眼识别 |
| **多代理复杂性** | 高级模式(委托/交接/编排)引入协调成本,简单场景可能过度设计 |

适合人群

  • 构建长期自主运行高频重复调用代理的开发者
  • 遭遇上下文压缩丢失幻觉报告交接丢单等具体故障的团队
  • 需要预发布检查清单或代理可靠性评审的技术负责人

使用建议

优先采用「信任链」「交接环」「生存包」「质量门」四大模式组合,而非孤立套用单点方案。

Battle-Tested Agent 内容

assets文件夹
references文件夹
scripts文件夹
手动下载zip · 15.1 kB
AGENTS-additions.mdtext/markdown
请选择文件