AI Image Generator & Editor — GPT Image 2, Nanobanana, ComfyUI

🎨 多提供商 AI 图像生成与编辑工具箱

creative榜 #33

AI 图像生成与编辑工具箱,整合多提供商路由、1300+精选提示词库与本地 ComfyUI 支持,适合设计师与创作者快速产出专业视觉资产。

收藏
8.6k
安装
2.5k
版本
1.0.23
CLS 安全性认证2026-06-23
点击查看完整报告 >

使用说明

核心用法

Creative Toolkit 是一个统一的 AI 图像生成接口,支持多提供商智能路由(Nanobanana 2、Seedream 5.0、GPT Image、Midjourney V7/Niji 7 及本地 ComfyUI)。核心工作流包括:

1. 灵感搜索:通过 search_gallery 语义检索 1300+ 精选提示词,配合 get_inspiration 获取完整提示与高清参考图
2. 提示增强enhance_prompt 将简短描述扩展为包含光照、构图、材质的专业级提示词,支持 realistic/anime/illustration 三档风格

3. 图像生成generate_image 自动选择最优提供商,支持 aspect ratio、seed、参考图等参数;本地文件自动压缩上传(最大 2MB/2048px)

4. ComfyUI 工作流:本地用户可通过 comfyui_workflow 管理、修改模板参数,无需手动编辑 JSON

显著优点

  • 零门槛入门:搜索、增强、灵感工具无需 API key 即可使用
  • 智能路由:无需手动指定模型/提供商,系统自动匹配最优选项
  • 多模态参考:支持 URL、本地路径、历史生成图作为风格参考,Midjourney 支持 --sref 风格代码
  • 工作流友好:从灵感搜索→提示增强→批量生成→衍生设计的完整创作链路

局限性与注意事项

  • 视觉盲区:AI 无法查看生成结果,仅能返回工具响应的 URL/路径数据,不能描述图像内容
  • Midjourney 参数锁定:stylize/chaos/weird 等高级参数固定为服务端默认值,仅 sref 可通过提示词尾部代码调整
  • Niji 7 内容限制:仅适用于 anime/illustration,强行用于写实内容效果不佳,需显式设置 style: 'anime' 进行提示增强
  • 并行限制:API 提供商最多 4 张并行,ComfyUI 本地工作流仅支持串行

适合人群

  • 需要快速产出概念图、产品摄影、角色设计的视觉创作者
  • 希望统一管理多 AI 提供商、避免在各平台间切换的工作室/团队
  • 拥有本地 ComfyUI 环境、追求参数精细控制的技术型用户

常规风险

  • 版权与合规:生成内容可能涉及训练数据版权争议,商业使用需确认各提供商条款
  • API 成本:Midjourney V7/Niji 7 单次 15 积分约 60 秒,高频使用需监控额度消耗
  • 本地环境依赖:ComfyUI 模式需要自行维护节点环境与模型文件,配置门槛较高

安全解读

核心用法

该Skill提供统一的多提供商AI图像生成路由能力,将文本提示转换为专业级图像。用户可通过mcporter快速调用,无需编写代码即可访问Nanobanana 2、Seedream 5.0、GPT Image、Midjourney V7/Niji 7等主流模型,以及本地ComfyUI工作流。

基础工作流

  • 免费功能search_gallery语义搜索1300+精选提示词,enhance_prompt将简短创意扩展为含光照、构图、材质细节的生产级提示词,get_inspiration获取完整提示文本
  • 图像生成:配置MeiGen Cloud Token、本地ComfyUI实例或OpenAI兼容API后,使用generate_image创建图像,支持比例控制、种子固定和参考图引导
  • 高级模式comfyui_workflow管理本地工作流模板,调整步数、CFG、采样器等参数;manage_preferences保存用户默认风格与收藏提示

关键设计约束

  • 生成后仅呈现工具返回的精确数据(URL、本地路径),禁止对图像内容做主观描述——系统无法"看见"生成结果
  • 禁止指定模型或提供商,由服务器自动选择最优可用资源,除非用户明确要求
  • Midjourney V7(写实/通用)与Niji 7(纯动漫插画)区分使用,后者必须配合style: 'anime'增强提示
  • 多图并行生成需用户确认方向后再执行,ComfyUI仅支持串行

显著优点

1. 多模型统一接口:打破单一模型局限,自动路由至最优提供商,降低多平台切换成本
2. 零门槛启动:免费工具(搜索、增强、灵感)无需API Key即可使用,降低新用户试用门槛

3. 本地优先支持:ComfyUI原生集成,支持本地文件路径直接传入,自动压缩处理(≤2MB/2048px),兼顾隐私与性能

4. 提示工程专业化:内置风格感知增强器,将"太空中的猫"扩展为含相机镜头、大气效果的完整指令,显著提升生成质量

5. 工作流可编程:通过comfyui_workflow在不编辑JSON的情况下调整生成参数,降低本地AI使用技术门槛

6. 参考图生态完整:支持URL、历史生成结果、本地文件三种引用方式,实现风格迁移、Logo mockup、图像编辑等进阶场景

潜在缺点与局限性

1. 视觉反馈缺失:系统无法感知生成结果,用户必须自行查看URL或本地文件确认质量,调试周期较长
2. Midjourney参数受限:stylize/chaos/weird等高级参数为服务器端固定值,仅支持sref风格代码注入,精细控制能力弱于官方Discord

3. T3来源信任成本:个人开发者维护(jau123),虽代码开源透明,但长期维护稳定性、安全响应速度存疑

4. 许可状态模糊:未明确声明开源许可证,存在潜在合规风险

5. 依赖外部商业服务:核心图像生成依赖MeiGen Cloud等第三方平台,存在服务变更、定价调整、区域可用性等不可控因素

6. 并行限制差异:ComfyUI仅支持单图串行,与API提供商的4图并行形成体验断层

适合人群

  • 设计师与创意工作者:需要快速探索多风格视觉概念,利用提示词库与增强功能提升生产效率
  • AI艺术爱好者:希望一站式体验Nanobanana、Midjourney、GPT Image等差异,无需订阅多个平台
  • 本地AI用户:已部署ComfyUI的技术用户,寻求更简洁的工作流管理与调用方式
  • 电商/营销从业者:产品图、mockup生成需求,利用参考图功能实现品牌视觉一致性

常规风险

  • API Token泄露:MEIGEN_API_TOKEN等凭证需本地安全存储(建议chmod 600),避免提交至版本控制
  • 生成内容合规:AI图像可能涉及版权、肖像权、有害内容,需遵守各提供商服务条款及当地法规
  • 成本失控:Midjourney V7/Niji 7单次15积分,批量生成前务必确认方向,避免无效消耗
  • 依赖锁定meigen@1.2.7等固定版本依赖需关注安全公告,及时更新以修复潜在漏洞
  • 本地文件路径安全referenceImages传入本地路径时,注意路径验证,防止目录遍历等注入风险

AI Image Generator & Editor — GPT Image 2, Nanobanana, ComfyUI 内容

references文件夹
手动下载zip · 7.0 kB
providers.mdtext/markdown
请选择文件