Self-Improving Agent (Anti-Loop Hardened)

✨ Self-Improving Agent (Anti-Loop Hardened)

Self-Improving Agent (Anti-Loop Hardened)

收藏
2.2k
安装
778
版本
2.0.0
CLS 安全性认证2026-08-03
点击查看完整报告 >

使用说明

安全解读

核心用法

Self-Improvement Skill 是一套面向 AI Agent 的自我学习与改进系统,专为 Claude Code、OpenClaw 等平台设计。其核心机制是在 Agent 运行过程中自动捕获三类关键信息:操作失败记录(命令或 API 异常)、用户明确修正(直接纠错语句)、缺失功能请求(用户想要但暂不支持的特性),并将这些信息以结构化格式追加写入本地 Markdown 日志文件(.learnings/ERRORS.md.learnings/LEARNINGS.md.learnings/FEATURE_REQUESTS.md)。

该技能采用严格的触发规则:仅在用户明确说"No, that's wrong"等直接纠错时记录学习;仅在命令失败或外部 API 异常时记录错误;仅在用户明确请求不存在功能时记录特性需求。每次用户消息最多触发 1 次学习日志,禁止连锁反应,整个流程限制在 ≤3 个工具调用内完成。

日志条目采用标准化 ID 格式(TYPE-YYYYMMDD-XXX),包含时间戳、优先级、状态、摘要、详情、建议修复等字段,便于后续人工审查和批量处理。定期回顾时可将高频学习条目提升(Promote)至 SOUL.md(行为模式)、AGENTS.md(工作流改进)或 TOOLS.md(工具使用技巧)。

显著优点

安全性设计领先:作为原版 self-improving-agent 的硬分叉(Hardened Fork),作者明确修复了原版的无限循环缺陷,引入 7 项 Anti-Loop Guardrails,包括单次消息最多 1 条学习、禁止连锁触发、最大 3 次工具调用限制、强制冷却期等,从根本上杜绝了自我调用导致的资源耗尽风险。

零外部依赖:无任何第三方库依赖,无网络 API 调用,所有数据本地化存储,符合 GDPR/CCPA 隐私合规要求,企业内网环境亦可安全使用。

结构化可审计:日志格式规范、ID 唯一、状态可追踪(pending/resolved),支持从学习记录到知识库(SOUL/AGENTS/TOOLS)的晋升流程,形成完整的学习闭环。

MIT-0 公有领域许可:最宽松的开源协议,允许无限制的商业使用、修改和分发,降低法律风险。

潜在缺点与局限性

T3 来源可信度:维护者为 GitHub 个人开发者(lanyasheng),非知名机构或企业背书,虽然 fork 自可信项目且有透明改进记录,但用户仍需自行评估长期维护风险。

非自动化智能:该技能本质上是结构化日志记录工具,本身不具备自动分析、归纳或自我修改代码的能力,需要用户或开发者定期手动审查学习日志并执行"Promotion"操作才能转化为实际改进。

日志膨胀风险:虽然文档建议定期检查 .learnings/ 目录大小,但未内置自动归档或清理机制,长期高频使用可能导致文件体积过大。

误触发边界模糊:区分"用户讨论/辩论"与"明确纠错"需要语义判断,在复杂对话场景中可能出现误判或漏判。

适合的目标群体

  • 个人开发者:使用 Claude Code、OpenClaw 等 Agent 平台进行日常开发,希望追踪 Agent 行为模式并持续调优 Prompt 或工作流。
  • 小型技术团队:需要低成本、零依赖的错误追踪和知识沉淀方案,暂不具备搭建完整 AIOps 或 LLM Ops 平台的能力。
  • AI Agent 研究者:研究 Agent 自我改进机制、循环安全(Loop Safety)或记忆系统设计的学术或工程人员。
  • 隐私敏感场景:金融、医疗、政府等对内网隔离、数据不出域有严格要求的组织。

使用风险

性能风险:虽然 Anti-Loop 机制有效,但在极端高频交互场景下,磁盘 I/O 操作(追加 Markdown 文件)可能成为瓶颈,建议监控 .learnings/ 目录的写入延迟。

数据敏感风险:日志条目可能意外捕获用户输入中的敏感信息(API 密钥、内部路径、业务数据),尽管文档建议脱敏,但实际依赖使用者的安全意识,建议启用前建立数据脱敏审查流程。

版本兼容性风险:Hook 机制(UserPromptSubmit、PostToolUse)依赖特定 Agent 平台(OpenClaw/Claude Code)的实现细节,平台升级可能导致钩子失效或行为变更。

维护可持续性:作为个人开发者维护的 T3 项目,存在维护者精力有限、issue 响应延迟、长期功能演进不确定等典型社区项目风险。

Self-Improving Agent (Anti-Loop Hardened) 内容

assets文件夹
hooks文件夹
openclaw文件夹
references文件夹
scripts文件夹
手动下载zip · 20.5 kB
LEARNINGS.mdtext/markdown
请选择文件