核心用法
Apprentice 是一种编程演示(Programming by Demonstration)技能,颠覆传统人机交互模式:用户不再描述需求,而是直接执行操作,Agent 观察记录并转化为永久技能。
使用流程:
1. 触发观察:说 "Watch me" 或 "Learn this" 进入观察模式
2. 自然执行:边操作边口述,Agent 记录命令、文件操作、决策逻辑
3. 结束观察:说 "Done" 触发智能合成
4. 审核确认:查看识别出的步骤、变量、常量,编辑或批准
5. 永久调用:通过 "Run [workflow-name]" 随时复用,支持参数注入和链式调用
技术亮点:LLM 驱动意图理解,区分变量与常量,支持跨上下文泛化,生成标准 OpenClaw SKILL.md 格式技能文件。
显著优点
- 零门槛自动化:无需编写代码或规格说明,口语化教学即可完成技能创建
- 意图级学习:不仅记录动作,更理解"为什么这样做",识别可参数化的变量
- 完全本地化:零外部 API 调用,观察日志和合成均在本地完成,隐私安全
- 可审阅机制:保存前必须人工确认,避免误学错误流程
- 生态兼容:生成标准技能文件,可分享至 ClawHub,支持技能间调用和链式编排
潜在局限
- 仅限可描述操作:GUI 点击、视觉判断等无法直接观察,需用户口述补充
- 沉默即盲区:不 narrate 的操作可能被遗漏
- 单会话学习:复杂多场景流程需分多次教学
- LLM 依赖:合成质量受当前会话模型能力影响,复杂逻辑可能需要人工编辑
- 无屏幕感知:无法自动识别界面元素状态变化
适合人群
- 开发者/运维:标准化项目初始化、部署、发布流程
- 团队管理者:固化 onboarding、周报生成、会议准备等重复协作流程
- 效率极客:希望将个人工作习惯转化为可复用自动化资产
- 非技术人员:有重复电脑操作需求但不愿学习编程的用户
常规风险
| 风险类型 | 说明 | 缓解措施 |
|---------|------|---------|
| 误学风险 | 用户操作失误被记录为"标准流程" | 强制审核环节,支持编辑和拒绝 |
| 权限继承 | 生成脚本以当前用户权限执行 | 沙箱化执行,生成带安全头部的 bash 脚本 |
| 敏感信息泄露 | 口述时可能提及密码、密钥等 | 本地处理,建议审计 observation.json |
| 变量识别错误 | 常量被误判为变量或反之 | 审核界面明确标注变量/常量,可手动修正 |
| 流程僵化 | 环境变化导致旧流程失效 | 支持重新教学覆盖,workflow 文件可版本管理 |