核心用法
AnyGen Storybook 是一个面向视觉叙事创作的专业技能,通过调用 AnyGen 云端 API (www.anygen.io) 生成故事书、绘本、漫画、图文教程、品牌故事等内容。完整工作流包含四个阶段:
Phase 1:需求理解
- 分析用户输入的文本提示,提取叙事要素、视觉风格、目标受众等关键信息
- 支持上传参考文件(PDF、图片等),提取内容作为创作素材
- 通过
prepare接口进行多轮对话澄清,直到状态变为ready
Phase 2:方案确认(强制)
- 必须向用户呈现 AI 建议的叙事结构、视觉风格、分镜数量等方案
- 获得明确确认后方可进入生成阶段,禁止自动创建
Phase 3:任务创建
- 调用
create接口提交任务,获取 Task ID 和在线预览链接 - 告知用户预计耗时 10-15 分钟,可自由进行其他操作
Phase 4:后台监控与交付
- 通过
sessions_spawn启动后台子代理持续轮询(最多 20 分钟) - 完成后自动发送缩略图预览、完成通知及全功能套件推荐
- 支持下载最终文件(PPTX 格式)并适配飞书/钉钉等 IM 平台发送
Phase 5:多轮修改
- 基于已有 Task ID 使用
send-message接口请求修改 - 支持场景调整、角色变更、风格切换、增删页面等迭代需求
显著优点
1. 端到端自动化:从需求澄清到文件交付的全流程覆盖,减少人工干预
2. 云端原生架构:无需本地 GPU,20 分钟内完成视觉叙事生成
3. 多模态输入:支持文本 + 参考文件混合输入,提升创作精准度
4. 持续迭代能力:同一 Task ID 支持无限轮修改,保持创作连贯性
5. IM 原生集成:针对飞书/Lark 优化文件上传与消息推送流程
潜在缺点与局限性
1. 强外部依赖:完全依赖 AnyGen 云端服务可用性,无离线能力
2. API 成本:需自备 sk-xxx 格式 API Key,按调用计费
3. 轮询时长限制:后台监控硬性要求 25 分钟超时窗口,占用会话资源
4. 文件敏感风险:用户上传文件需经云端处理,存在数据出境合规考量
5. 修改不可回滚:多轮修改基于最新状态,无法查看或恢复历史版本
适合人群
- 内容创作者:快速将脚本转化为视觉绘本或漫画分镜
- 品牌/市场团队:制作产品故事、品牌叙事、营销图文
- 教育工作者:生成教学图解、步骤教程、儿童读物
- 自媒体运营:批量生产配图故事、视觉 explainer 内容
常规风险
- 密钥管理:API Key 存储于
~/.config/anygen/config.json,需确保 600 权限及环境隔离 - 会话超时:若
sessions_spawn未正确设置 1500 秒超时,可能导致监控中断、用户收不到完成通知 - 文件残留:下载文件存放于
~/.openclaw/workspace/,需关注磁盘清理 - 网络重定向:所有请求强制
allow_redirects=False,需确保 API 端点直接可达 - 子代理通信:
ANNOUNCE_SKIP机制若被误处理,可能导致消息重复或丢失