核心用法
豆包生图技能是一套面向视觉设计师的AI图像生成工作流,依托豆包AI创作平台实现从需求确认到成品交付的完整闭环。其标准化流程包含十个关键节点:启动创作界面→主动询问用户需求→输入提示词→设置画面比例(默认3:4,可自定义)→触发生成→截图呈现候选方案→用户选择确认→大图预览→下载原图→自动归档至D盘指定目录。
显著优点
该技能建立了严格的人机交互确认机制,通过"生成前必问用户"的硬性规则有效避免AI误判需求;子Agent截图并通过message工具直接发送图片,相比虚拟路径更具可视化反馈;强制性的本地归档流程(自动复制到D:\OpenClaw\downloads\images\)便于后续素材管理;十步流程的颗粒度设计适合教学场景与团队协作标准化。
潜在局限
1. 平台依赖性:完全绑定豆包AI生态,无法迁移至Midjourney、Stable Diffusion等其他生图引擎
2. 操作刚性:"禁止回车键发送"等细节规则增加了操作记忆成本
3. 路径硬编码:截图路径/home/success/.openclaw/media/browser/和归档路径均写死,跨平台部署需修改
4. 无自动重试:未设置生成失败时的回退策略
5. 版权盲区:未提及豆包AI生成内容的商用授权边界
适合人群
- 视觉设计团队:需统一AI出图流程的中小设计组
- AI技能培训师:流程颗粒度适合作为RPA+AI协同的教学案例
- 个人设计师:习惯豆包生态且追求归档规范性的用户
常规风险
- 路径泄露风险:绝对路径暴露系统用户名(success)及目录结构
- 存储单点故障:D盘归档无校验机制,磁盘满或权限不足将导致流程中断
- 截图残留:浏览器缓存路径的临时文件未设置自动清理策略