AI Image Generator & Editor — GPT Image 2, Nanobanana, ComfyUI

🎨 多模态图像生成与创意工作流中枢

创意与设计榜 #6

多提供商 AI 图像生成中枢,支持 GPT Image、Midjourney V7/Niji 7 等主流模型,内置 1300+ 精选提示词库,提供免费提示增强与本地 ComfyUI 工作流管理。

收藏
6.9k
安装
2.5k
版本
1.0.24
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

AI Image Generation & Editor 是一个统一的多提供商图像生成接口,通过单一 MCP 服务器聚合 Nanobanana 2、Seedream 5.0、GPT Image、Midjourney V7(写实)、Midjourney Niji 7(动漫)及本地 ComfyUI 工作流。核心能力分为三层:

免费层(无需 API Key)search_gallery 支持语义搜索 1300+ 精选提示词;get_inspiration 获取完整提示与参考图;enhance_prompt 将简短想法扩展为包含光影、构图、材质的完整提示词,支持 realistic/anime/illustration 三种风格;list_models 查看可用模型。

生成层(需配置提供商)generate_image 自动路由最优提供商,支持比例、种子、参考图;本地文件路径可直接传入 referenceImages,自动压缩处理(≤2MB, 2048px)。comfyui_workflow 支持本地工作流的列出、查看、导入、修改与删除,可调整 steps、CFG、sampler 等参数而无需编辑 JSON。

工作流模式:涵盖单图生成、提示增强→生成、并行多方向生成(最多 4 张)、多步创意(基础设计+衍生)、图像编辑修改(传参考图+简短编辑指令)、灵感搜索、参考图风格迁移、ComfyUI 工作流调用共 8 种模式。

显著优点

1. 多提供商智能路由:自动选择最优后端,避免单点依赖,用户无需手动指定 model/provider。
2. 本地优先设计:ComfyUI 完全本地运行,无需外发 API;本地文件直接处理,压缩与格式转换在端侧完成。

3. 1300+ 提示词库:语义搜索降低创作门槛,灵感获取可复制修改。

4. 风格感知增强enhance_prompt 针对不同模型优化输出,Niji 7 强制 anime 风格标签,避免风格错配。

5. 渐进式工作流:从免费搜索/增强到付费生成,降低试用成本;多步创意模式强制用户确认,避免资源浪费。

潜在缺点与局限性

1. 视觉黑箱:AI 无法看到生成结果,只能返回 URL 与路径,用户需自行打开验证质量。
2. Midjourney 参数锁死:stylize/chaos/weird/raw/iw/sw/sv 等高级参数为服务器端固定值,仅 sref 可通过提示词尾部 --sref <code> 调整,且仅限 Midjourney 官方风格码。

3. Niji 7 内容受限:强制 anime/illustration,无法用于写实、产品摄影,误用会导致输出风格错位。

4. ComfyUI 串行限制:本地工作流一次仅生成一张,并行生成仅限 API 提供商(最多 4 张)。

5. 参考图压缩损耗:自动压缩可能损失细节,对精细纹理任务有影响。

6. 依赖外部 Node 生态:需 npxnodemcporter 二进制环境,配置门槛对非技术用户较高。

适合人群

  • 设计师与创意工作者:需快速产出概念图、素材、mockup。
  • AI 艺术爱好者:希望一键切换 Midjourney/GPT Image/本地模型对比效果。
  • 开发者与自动化工作流:通过 MCP 将图像生成嵌入脚本、CI/CD、内容流水线。
  • 隐私敏感用户:倾向本地 ComfyUI 运行,避免云端上传原图。

常规风险

  • 版权与合规:生成内容可能涉及训练数据版权争议;商业使用前需确认各提供商 ToS(Midjourney 商业授权需付费计划,GPT Image 受 OpenAI 使用政策约束)。
  • API 密钥管理MEIGEN_API_TOKENopenaiApiKey 需妥善存储于 ~/.clawdbot/.env 或加密配置,避免泄露。
  • 本地路径注入referenceImages 接受本地路径,需确保传入路径经过验证,防止路径遍历读取敏感文件(尽管压缩处理在本地,恶意路径仍可尝试访问)。
  • 成本失控:Midjourney V7/Niji 7 单次 15 积分约 60 秒,并行生成 4 张即 60 积分,高频调用需监控配额。

安全解读

核心用法

本 Skill 是一个纯文档型 MCP 服务器配置指南,本身无可执行代码,通过引导用户运行 npx meigen@1.2.8 调用外部图像生成服务。核心能力包括:

多提供商智能路由:自动在 Nanobanana 2、Seedream 5.0、GPT Image、Midjourney V7/V7 Niji 及本地 ComfyUI 间选择最优模型,无需手动指定。

提示词工程工具集

  • search_gallery / get_inspiration:语义搜索 1300+ 精选提示词库
  • enhance_prompt:将简短概念扩展为含光照、构图、材质细节的生产级描述
  • list_models:查看各提供商模型能力与定价

图像生成与工作流

  • generate_image:文生图,支持图生图(referenceImages)、自定义比例、种子控制
  • comfyui_workflow:管理本地 ComfyUI 模板,可调整 steps、CFG scale、sampler 等参数

关键约束规则

  • AI 无法查看生成结果,必须原样呈现工具返回的 URL 与本地路径,禁止创意性描述
  • 禁止主动传入 modelprovider 参数,由服务器自动决策
  • Midjourney V7 用于写实/摄影,Niji 7 仅限动漫插画;混用会导致风格崩坏
  • 批量生成前必须确认方向,禁止擅自生成全部变体

显著优点

1. 一站式多模型接入:单接口覆盖商业 API(Midjourney、GPT Image)与开源方案(ComfyUI),降低多平台切换成本
2. 零成本入门:搜索、提示词增强等核心工具无需 API Key,降低试用门槛

3. 本地优先支持:ComfyUI 集成让隐私敏感用户可在本地完成全部生成流程

4. 生产级提示词库:1300+ 经过验证的提示词减少"抽卡"时间,提升出图成功率

5. 清晰的分阶段工作流:8 种标准模式(单图/增强/并行/多步创意/编辑/灵感搜索/参考图/ComfyUI)覆盖从概念到成品的完整链路

潜在缺点与局限性

| 问题 | 说明 |
|------|------|
| 运行时依赖外部 npm 包 | 实际代码在 `meigen@1.2.8` 中,Skill 仅作配置引导,该包未经验证审查 |
| Midjourney 高级参数锁定 | stylize/chaos/weird 等参数固定为服务器默认值,无法从 MCP 端调节 |
| 无法预览生成结果 | AI 端看不到图片,用户需自行打开 URL 或本地文件确认效果 |
| 并行生成限制 | API 提供商最多 4 张并行,ComfyUI 仅支持串行,大规模批量生成效率受限 |
| 来源可信度 T3 | 个人开发者项目,非企业级维护,长期稳定性与合规支持存疑 |
| 本地文件自动压缩 | referenceImages 超过 2MB/2048px 会被压缩,可能损失细节 |

适合人群

  • 视觉设计师:需要快速产出概念稿、情绪板、产品 mockup
  • 独立开发者/创作者:为社交媒体、游戏、内容创作批量生成素材
  • AI 艺术爱好者:希望系统学习提示词工程,利用精选库降低入门门槛
  • 隐私敏感用户:优先使用 ComfyUI 本地工作流,避免数据上传云端

常规风险

1. 外部依赖供应链风险:核心功能依赖未审查的 npm 包,若作者账号被盗或包被投毒,用户环境将受威胁。建议定期 npm view meigen 验证包完整性。
2. API 费用累积:Midjourney V7/Niji 7 单次 15 积分约 60 秒,高频使用需关注 meigen.ai 账户余额。

3. 版权与内容合规:AI 生成图像的版权归属因司法管辖区而异,商用前需确认平台条款与本地法规。

4. 提示词注入风险:用户输入的提示词若包含恶意指令,可能通过参考图上传或提示词增强环节影响生成结果,但此类风险主要存在于底层模型而非本 Skill 层。

AI Image Generator & Editor — GPT Image 2, Nanobanana, ComfyUI 内容

references文件夹
手动下载zip · 7.1 kB
providers.mdtext/markdown
请选择文件