核心用法
baoyu-infographic 是一款结构化信息图生成工具,采用「布局×风格」双维度设计系统。用户输入文本内容后,工具通过 7 步工作流完成从内容分析到成品输出的全流程:
1. 内容分析(Step 1-2):解析主题、数据类型、受众与语调,生成结构化内容大纲,严格保留原始数据(自动脱敏敏感信息)
2. 组合推荐(Step 3):基于 21 种布局(时间线、对比矩阵、层级金字塔、漏斗图等)和 22 种视觉风格(手绘、赛博朋克、学术复古、3D 粘土等)智能匹配,支持关键词快捷触发
3. 用户确认(Step 4):强制确认环节,需用户批准布局×风格组合、画幅比例、语言及图像后端后方可生成
4. 图像生成(Step 5-6):按优先级调用 Codex imagegen、运行时原生工具或外部后端,支持参考图风格迁移,输出前自动备份旧文件
显著优点
- 模块化设计自由度高:21×22=462 种组合,配合关键词快捷入口(如「高密度信息大图」自动推荐
dense-modules布局),覆盖 timeline、对比图、技术示意图等全场景 - 数据保真机制:结构化内容阶段禁止摘要改写,数据点、引文必须原样复制,仅脱敏密钥类信息
- 工程化输出规范:强制 prompt 文件留存(
prompts/infographic.md)、自动备份策略、slug 命名冲突解决,确保可复现性 - 多后端兼容:Codex、Hermes、baoyu-imagine 等自动探测与降级,支持
preferred_image_backend偏好锁定
潜在缺点与局限
- 强制确认门槛:默认必须人工确认 Step 4,批量自动化场景需显式传入
--no-confirm - 文本渲染依赖模型:信息图内含大量标签、数据值,若后端模型文字生成能力弱(如早期扩散模型),易出现乱码或不清文字;规则明确禁止后期代码覆盖修复,只能重跑生成
- 无矢量输出:仅支持栅格图(PNG),不支持 SVG/AI/PDF 等可编辑格式,后续修改需重新生成
- 中文生态适配:22 种风格以西方视觉语言为主(Cyberpunk、Corporate Memphis 等),中式信息图常用风格(国潮、水墨、卷轴)未内置
适合人群
- 内容创作者、教育工作者、产品经理:需将复杂文本快速转化为社交媒体/演示文稿友好的视觉摘要
- 技术文档工程师:需生成技术示意图、API 流程图、架构拆解图
- 数据记者:需高密度数据叙事,但接受栅格图输出限制
常规风险
- 敏感信息泄露:内容分析阶段虽脱敏密钥,但用户若粘贴含 PII 的原始文本,结构化内容仍会保留;建议预清理
- 版权与参考图:
--ref引入的参考图若涉第三方版权,生成结果可能受风格迁移后的衍生风险 - 后端可用性:若运行时无原生图像工具且未安装任何后端,生成流程将阻塞,需用户介入选择