核心用法
baoyu-article-illustrator 是一款专为内容创作者设计的文章配图自动化工具。其工作流程分为六个步骤:预检查(加载 EXTEND.md 配置)、内容分析(识别 2-5 个核心论点及配图位置)、设置确认(通过 AskUserQuestion 交互确认风格参数)、大纲生成(输出 outline.md)、批量生成(按批次调用图像后端)、最终插入(自动写入 Markdown 引用)。
用户可通过 --type、--style、--palette 三维度自由组合,或直接使用 --preset 预设快速启动。支持的配图类型包括信息图(infographic)、场景图(scene)、流程图(flowchart)、对比图(comparison)、框架图(framework)、时间线(timeline)等六种。风格库涵盖 notion、warm、minimal、blueprint、watercolor、elegant 等多种渲染风格。
显著优点
1. 工业化配图流程:将传统「人工找图-设计沟通-反复修改」的链路压缩为「文章输入-参数确认-自动出图」的分钟级流程,特别适合技术博客、教程文档、方法论文章的高频产出场景。
2. 严格可复现性:强制要求将完整 prompt 写入独立文件(prompts/NN-{type}-{slug}.md)后再调用后端,支持跨后端迁移、版本回溯与团队协作。
3. 智能后端适配:自动检测 Codex imagegen、Hermes image_generate 等运行时原生工具,同时支持 baoyu-imagine 等第三方 skill,无可用后端时主动询问用户而非静默降级。
4. 批量生成策略:优先使用后端原生批处理接口,其次利用运行时并行调用能力(默认 4 张/批次),最后退化为串行,最大化利用计算资源。
潜在缺点与局限性
- 依赖外部图像后端:本身不内置绘图能力,若用户环境无可用后端则需手动配置或安装额外 skill。
- 风格一致性挑战:跨后端迁移时,相同 prompt 可能产生视觉差异,需人工校验或迭代 prompt。
- 文本渲染限制:明确禁止对生成后的位图进行文字修补(如 OCR 覆盖、SVG 叠加),若文字错误需重新生成,可能增加 token 消耗。
- 中文长文本场景未明确优化:prompt 构造指南强调 LABELS 需包含实际数据,但未针对中文排版、竖排、书法字体等特殊需求提供专门模板。
适合人群
技术写作者、知识付费创作者、教育内容生产者、产品文档维护者,以及任何需要将长文本转化为可视化叙事、但缺乏专职设计资源的中小团队。
常规风险
- 版权与授权:若使用参考图片(
--ref)进行风格迁移,需确保参考图来源合法,避免潜在侵权。 - 幻觉与事实偏差:信息图生成依赖 LLM 提取文章数据,若原文数据有误,可视化结果将放大错误。
- 过度生成风险:高密度(
rich模式)配置下,单篇文章可能生成 6 张以上图片,需关注存储成本与读者阅读负担。