核心用法
baoyu-comic 是一款知识漫画生成技能,旨在将教育性内容转化为视觉叙事。其工作流程涵盖:内容分析 → 风格确认 → 故事板生成 → 提示词撰写 → 图像生成 → PDF 合并。用户可通过 --art、--tone、--layout 等参数精确控制视觉风格,或选用 ohmsha、wuxia、four-panel 等预设快速匹配内容类型。
显著优点
1. 系统化工作流:9步结构化流程,含多个用户确认节点(Step 2/4/6),确保输出符合预期
2. 风格组合丰富:6种艺术风格(ligne-claire、manga、realistic 等)× 7种叙事基调(warm、dramatic、energetic 等),支持 42+ 种视觉组合
3. 角色一致性机制:通过 character sheet(characters/characters.png)作为参考图像注入多页生成,解决 AI 漫画角色漂移难题
4. 模块化设计:支持 --storyboard-only、--prompts-only、--regenerate N 等局部工作流,便于迭代优化
5. 智能后端选择:优先使用 Codex 原生 imagegen,兼容 baoyu-imagine 等外部技能,无可用后端时主动询问而非降级
潜在局限
- 依赖外部图像生成:核心功能依赖后端可用性,若未配置
preferred_image_backend且无运行时原生工具,将中断流程询问用户 - 首次配置阻塞:EXTEND.md 偏好配置为强制步骤,新用户需完成配置才能进入内容生成
- 生成耗时:每页 10-30 秒,长漫画需耐心等待
- 敏感人物处理:对公众人物自动采用风格化替代,可能偏离写实需求
适合人群
- 教育工作者需要将课程/传记转化为可视化教材
- 技术博主制作教程图解(tutorial comic)
- 知识类自媒体创作者追求 "Logicomix 风格" 的深度叙事
- 需要多语言输出(zh/en/ja 等)的国际化内容团队
常规风险
- 版权水印:EXTEND.md 可配置
watermark.enabled,需注意商用授权 - 提示词文件依赖:强制要求
prompts/NN-{type}-[slug].md前置存在,直接调用图像工具而不维护提示词文件将导致工作流断裂 - 参考图像压缩:字符表作为
--ref时需压缩为 JPEG(quality 80),高分辨率原图可能引发 payload 失败