qwenz-image-gen

🎨 智能双模文生图,中文人像皆精通

基于阿里云百炼的文生图技能,智能识别场景自动选择Qwen-Image或Z-Image模型,专精中文文字渲染与高质量人像生成

收藏
5.5k
安装
1.4k
版本
1.0.1
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

Qwen-Image技能是阿里云百炼平台的文生图工具,采用智能场景识别机制自动切换最优模型:人像/照片场景自动调用z-image-turbo(专精胶片质感、真实人像),通用文图场景自动调用qwen-image-max(擅长复杂文字渲染、艺术风格)。用户可直接输入提示词,无需手动选择模型;也支持通过--model参数强制指定。

关键特性

  • 双模型智能调度:自动检测"人/女/男/少女/photo/film grain"等关键词触发z-image
  • 中文文字渲染:qwen-image-max在图文混排、复杂中文字符生成上表现优异
  • 多尺寸支持:6种预设比例,人像推荐4:5(1120*1440),通用默认16:9
  • 提示词扩展--prompt-extend自动优化原始描述

显著优点

1. 场景自适应省心:无需用户了解模型差异,AI自动匹配最佳后端
2. 国产中文优化:相比Midjourney/SD,中文字符嵌入图像的准确性显著提升

3. 人像真实感强:z-image-turbo在面部细节、皮肤质感、胶片颗粒效果上专业级表现

4. 企业级稳定性:阿里云百炼提供标准化API,响应可控

潜在局限

  • 地域隔离:北京/新加坡API Key不互通,跨地域部署需额外配置
  • 提示词长度限制:正向≤800字符、负向≤500字符,复杂场景描述受限
  • 风格可控性:自动模式虽便捷,但精细控制需手动指定模型参数
  • 版权水印:默认带水印,需显式关闭

适合人群

  • 中文内容创作者:需要生成含中文字符的插画、海报、漫画
  • 人像摄影/写真从业者:追求胶片质感、真实皮肤纹理的AI人像生成
  • 企业设计团队:需要稳定API服务、符合国内合规要求的文生图工作流

常规风险

  • API密钥管理:DASHSCOPE_API_KEY需安全存储,避免硬编码泄露
  • 生成内容合规:需遵循阿里云百炼平台的内容审核政策
  • 版权归属:商用前需确认阿里云生成的图像版权条款

qwenz-image-gen 内容

scripts文件夹
手动下载zip · 6.9 kB
generate.pytext/plain
请选择文件