Moark Image Gen

🖼️ 多模型 AI 绘图,一键生成高质量图像

调用 Gitee AI 多模型 API 生成高质量图像,支持 FLUX、Kolors、HunyuanDiT 等主流文生图模型,提供丰富的尺寸与参数调优能力。

收藏
4.1k
安装
1.2k
版本
1.0.1
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

moark-image-gen 是一款基于 Gitee AI 平台的文生图技能,封装了 OpenAI 兼容接口的图像生成能力。用户通过自然语言描述即可调用 Qwen-Image(默认)、Kolors、GLM-Image、HunyuanDiT-v1.2-Diffusers-Distilled 及 FLUX.2-dev 等多款模型生成图像。

典型调用流程:
1. 用户输入图像描述(prompt)

2. 系统执行 perform_image_gen.py 脚本,解析 IMAGE_URL: 输出行

3. 返回 Markdown 格式图片链接,并附模型参数说明

关键参数配置:

  • 尺寸选择:从 256×256 到 2048×2048 共 10 种规格,涵盖 1:1、16:9、9:16、4:3 等常用比例
  • 负向提示(negative-prompt):默认过滤低质量、畸形肢体、AI 感过重等常见问题
  • 推理步数(num-inference-steps):模型相关范围 10-50,越高细节越丰富
  • 引导系数(guidance-scale):控制提示词忠实度,FLUX/Kolors 支持 0-100 宽域调节

质量调优机制:内置用户反馈响应策略——画质不足时提升步数,提示词偏离时调整 guidance-scale,过度饱和则反向降低。

显著优点

  • 模型覆盖全面:集成 5 款差异化模型,FLUX.2-dev 擅长高美学质量,Kolors 优化中文理解,HunyuanDiT 专注细节渲染
  • 参数颗粒度细:10 种预设尺寸 + 可调步数/引导系数,满足从快速草稿到精细成图的多元需求
  • 负向提示智能:预置中文负面标签库,降低畸形、过饱和、AI 蜡像感等常见问题
  • 交互闭环设计:支持基于用户反馈的自动重试与参数修正,提升一次生成成功率

潜在局限

  • 单 API 依赖:仅绑定 Gitee AI 单一供应商,无备选服务熔断机制
  • 无本地推理:必须联网并持有有效 GITEEAI_API_KEY,离线场景无法使用
  • 模型黑箱性:未暴露底层 LoRA、ControlNet 等进阶控制能力,专业用户定制空间有限
  • 成本不透明:依赖外部 API 计费,高频调用可能产生不可控费用

适合人群

  • 内容创作者:快速生成配图、概念草图、社交媒体素材
  • 开发者/设计师:需批量生成特定风格图像进行原型验证
  • AI 应用搭建者:寻求低代码集成文生图能力的 Agent 构建者

常规风险

  • API 密钥泄露风险GITEEAI_API_KEY 需妥善保管,硬编码或日志泄露可能导致账户盗用
  • 内容合规风险:生成图像可能触及版权、肖像权或敏感内容政策,需遵守 Gitee AI 服务条款
  • 输出不确定性:同一 prompt 多次生成结果存在随机性,关键商业用途需人工审核
  • 服务可用性:依赖第三方 API 稳定性,高峰期可能出现延迟或限流

Moark Image Gen 内容

scripts文件夹
手动下载zip · 5.2 kB
perform_image_gen.pytext/plain
请选择文件