Ralph Loops

✨ 让AI自主迭代编码的智能循环引擎

基于Ralph Wiggum技术的自主AI开发循环工具,通过三阶段工作流实现迭代式系统构建,单次迭代成本$0.50-8.00

收藏
12.4k
安装
4.9k
版本
1.0.2
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心机制

Ralph Loops 是 Geoffrey Huntley 提出的"Ralph Wiggum"自主开发技术的实现框架,由 Clayton Farr 系统化整理。核心哲学是"人类角色从'告诉代理做什么'转变为'工程化条件,让好结果通过迭代自然涌现"。

三阶段工作流

| 阶段 | 目标 | 输出 |
|------|------|------|
| **Phase 1: 需求访谈** | 与人工讨论JTBD(任务驱动成果),拆解为Topics | `specs/*.md` |
| **Phase 2: 规划** | 对比spec与现有代码的gap分析,生成任务列表 | `IMPLEMENTATION_PLAN.md` |
| **Phase 3: 构建** | 单次迭代完成一个任务,验证后提交,重置上下文 | 可运行的代码 |

关键设计原则

1. 上下文稀缺 — 每轮迭代仅~176K可用token,保持精简
2. 计划可丢弃 — 漂移的计划重新生成比修复更便宜

3. 背压优于指令 — 用测试/类型检查等自动拒绝错误输出

显著优点

  • 上下文隔离:每次迭代启动新Claude会话,错误不累积,可用token全部分配给当前任务
  • 自主运行:启动后可异步执行,人类可继续对话,通过Dashboard实时监控
  • 验证闭环:内置downstream gates(测试/lint)、upstream steering(代码规范)、LLM-as-judge三层背压
  • 成本可控:简单功能$1-2,复杂功能$3-8,完整项目$15-50+
  • 真实战果:YC黑客夜生成6个仓库,$5万合同以$297 API成本完成

潜在局限

  • 需Claude Code 2.1.25:2.1.29有严重bug导致孤儿子代理99% CPU
  • 需`--dangerously-skip-permissions`:绕过权限系统,必须在隔离环境运行
  • 首次配置较重:需自定义PROMPT_plan.md、PROMPT_build.md、AGENTS.md三个模板文件
  • 无Git则功能受限:依赖git commit作为检查点,无版本控制需额外配置

适合人群

  • 有明确需求但不愿逐行编码的开发者
  • 需要快速原型验证的初创团队
  • 熟悉Node.js/npm生态的工程师(当前实现为JS)
  • 能接受$10-50 API成本换取数小时开发时间的场景

常规风险

| 风险 | 缓解措施 |
|------|----------|
| 权限绕过被滥用 | 文档强制要求在Docker/VM中运行,仅暴露必要API密钥 |
| 计划漂移导致循环 | 检测机制:计划陈旧时自动回归Phase 2重新生成 |
| 子进程管理失控 | killLoop使用sessionId+4字符hash精确匹配,超时自动清理 |
| 上下文爆炸 | "单任务单迭代"强制约束,AGENTS.md限60行以内 |

使用模式

./loop.sh plan          # 规划模式
./loop.sh build 20      # 构建模式,最多20轮
node ralph-loop.mjs --prompt task.md --max 10 --done "RALPH_DONE"

安全解读

技能核心用法

Ralph Loops 是一个基于 Claude Code 的自主 AI 代理循环框架,源自 Geoffrey Huntley 的 Ralph Wiggum 技术并由 Clayton Farr 记录整理。它通过「需求访谈 → 差距规划 → 迭代构建」三阶段工作流,让 AI 代理以「每次迭代一个任务」的方式自主完成软件开发。

核心工作流程分为三个阶段:Phase 1 通过结构化对话采集用户需求(JTBD),拆分为独立主题并生成规格文档;Phase 2 对比规格与现有代码库进行差距分析,生成优先级排序的实施计划;Phase 3 逐一执行任务,每次迭代使用全新上下文,完成后自动提交 Git 变更并按需推送。

配套工具包括 Node.js 循环脚本ralph-loop.mjs)、Web 仪表板(localhost:3939 实时监控)以及可直接复用的模板文件(Prompts、AGENTS.md、loop.sh),支持自定义最大迭代次数和完成条件。

显著优点

1. 上下文管理精妙:每次迭代使用全新 Claude 上下文,避免积累错误和幻觉,保持 Agent 在「智能区」内工作。
2. 三阶段分离清晰:需求、规划和构建各司其职,规划偏移时可快速且低成本地重新生成,而非强行修复。

3. 多层背压机制:通过硬性检查(测试/类型检查)、软性引导(现有代码模式)和 LLM 主观评审三层反馈,确保输出质量自主收敛。

4. 真实成果验证:据 Geoffrey 本人实践,在 YC 黑客马拉松中用一夜生成 6 个仓库,5 万美元合同仅消耗 297 美元 API 费用,3 个月内创建了整个编程语言。

5. 成本可控:规划阶段通常 1-2 次迭代($0.50-$1.00),简单功能 3-5 次迭代($1-$2),完整项目构建约 $15-$50+。

潜在缺点与局限性

1. 严重依赖权限绕过:核心功能通过 --dangerously-skip-permissions 完全绕过 Claude Code 权限系统,Agent 的所有工具调用均在无人工确认下执行,显著扩大攻击面。
2. Dashboard 安全薄弱:Web 仪表板无认证机制、CORS 全放通、暴露进程终止 API,本地任意进程均可调用。进程终止功能使用 pgrep -f 模糊匹配,可能误杀无关进程。

3. 命令注入风险--check-cmd 参数通过 execSync() 直接执行任意 Shell 命令,缺乏白名单或沙箱限制。

4. Claude Code 版本敏感:2.1.29 版本存在致命 Bug(产生孤儿子代理消耗 99% CPU),必须先降级至 2.1.25 才能正常使用。

5. 来源不可验证:代码由内部平台用户维护,无公开 GitHub 仓库或组织背书,无许可证声明,缺乏社区审查。

6. 自动 Git Push 存在隐患:模板默认在每次迭代后自动推送至远程仓库,未经审查的代码变更或敏感信息可能被意外泄露。

适合的目标群体

  • 独立开发者与创业者:希望在有限资源下快速原型化复杂系统的技术创始人。
  • AI 工具深度用户:已熟悉 Claude Code/Clawdbot 生态,愿意承担权限绕过风险的进阶用户。
  • Hackathon 参赛者:需要短期内产出多个完整项目的高效建造者。
  • 技术团队负责人:寻求将 AI 代理集成到标准化开发流程中的工程管理者(需额外安全加固)。
  • Claude Code 研究者:对自主代理循环、迭代开发工程实践感兴趣的学术界或工业界人士。

使用风险提示

  • 权限失控风险--dangerously-skip-permissions 标志使 Agent 在循环期间拥有完全自主权,建议仅在隔离环境(Docker/VM)中运行,限制可用 API 密钥和网络访问。
  • 意外代码破坏:若背压机制(测试/类型检查)配置不当或缺失,Agent 可能提交破坏性变更。建议保留 git reset --hard 回退能力,并为关键分支设置保护规则。
  • 账单失控:若不设置最大迭代次数(--max),循环可能无限运行导致 API 费用暴涨,建议始终设置合理的上限并监控 Dashboard 进度。
  • 依赖项维护成本:需自行排查 Claude Code 版本兼容性(参考已知的 2.1.29 Bug)、Node.js 运行时环境和 npm 依赖的安全公告。
  • 知识产权不明:因无明确许可证,商用项目使用该框架需自行承担法律风险,建议使用前明确许可条款或联系维护者。

Ralph Loops 内容

dashboard文件夹
lib文件夹
public文件夹
routes文件夹
scripts文件夹
templates文件夹
手动下载zip · 50.8 kB
cost-calculator.mjstext/javascript
请选择文件