核心功能
baoyu-infographic 是一款面向专业场景的信息图生成技能,通过「布局(信息结构)× 风格(视觉美学)」双维度组合,将文本内容转化为高信息密度的可视化输出。核心能力包括:
- 21种布局:从线性时间轴(
linear-progression)、双栏对比(binary-comparison)到高密度模块(dense-modules)、仪表盘(dashboard)等,覆盖叙事、对比、层级、流程、空间等全场景信息结构 - 22种视觉风格:涵盖手工纸艺(
craft-handmade,默认)、赛博霓虹(cyberpunk-neon)、复古学术(aged-academia)、孟菲斯扁平(corporate-memphis)、乐高积木(lego-brick)等多元美学 - 智能推荐:基于内容类型自动推荐最佳组合(如「时间线」推荐
linear-progression+craft-handmade,「技术指南」推荐dense-modules+pop-laboratory) - 多语言输出:支持中英文及多语言内容适配
- 参考图引导:可接收风格/配色/构图参考图,提取特征融入生成
显著优点
1. 结构化工作流:从内容分析(analysis.md)→ 结构化内容(structured-content.md)→ 提示词生成 → 图像输出,全流程可追溯、可复现
2. 硬约束安全机制:强制确认策略(Confirmation Policy)确保关键参数(布局×风格、比例、语言、后端)经用户确认后才执行生成;自动剥离凭证/密钥等敏感信息
3. 后端解耦设计:支持 Codex imagegen、Hermes image_generate、baoyu-image-gen 等多种图像后端,通过 EXTEND.md 配置即可切换
4. 版本与备份机制:关键文件(source.md、analysis.md、infographic.png)自动带时间戳备份,避免覆盖丢失
5. 像素级文本策略:明确禁止用代码覆盖修复生成图像中的文字错误,强制通过重新生成解决,保障视觉品质
潜在局限
- 生成依赖外部后端:本身不内置图像渲染能力,需依赖配置的图像生成服务,后端不可用时会中断流程
- 高密度文本场景受限:复杂文字排版仍可能出现渲染瑕疵,需人工校验或选择「少文字」布局
- 无实时预览:生成前无法预览效果,需依赖推荐系统的准确性
- 参考图处理有限:若后端不支持直接参考图输入,仅能提取风格特征文本描述,可能损失细节
适合人群
- 内容运营、教育工作者:快速将长文、报告、教程转为社交媒体传播图
- 产品经理、数据分析师:制作指标仪表盘、流程说明、对比矩阵
- 设计师:作为视觉原型起点,或批量生成风格统一的系列图表
- 开发者/技术写作者:输出技术架构图、API 指南、部署流程图
常规风险
- 版权与素材:生成图像的版权归属取决于所用后端模型的训练数据政策,商用需确认合规
- 信息保真:自动剥离敏感信息的机制可能过度过滤,关键数据需人工复核
- 风格漂移:同一组合多次生成可能存在细微差异,对品牌一致性要求高的场景需固定种子或后期规范
- 后端稳定性:依赖外部服务时存在可用性风险,建议配置 fallback 或本地后端