核心用法
wuli 是面向 Wuli.art 开放平台的命令行 AI 图像与视频生成工具,封装了 15+ 款国产前沿模型的 API 调用能力。核心工作流为:配置 API Token → 选择 action(image-gen/image-edit/txt2video/image2video)→ 提交生成任务 → 自动轮询结果 → 无水印下载。
图像生成支持文生图(text-to-image)与图生图(image-to-image),可选 Qwen Image 2.0/25.08、Seedream 4.5/4.0、通义万相 2.6 等模型,分辨率覆盖 1K-4K,支持 1:1 到 21:9 多种画幅,单次可批量生成 4 张图。
视频生成涵盖文生视频(txt2video)与图生视频(image-to-video),集成通义万相 2.2 Turbo/2.6、可灵 O1/2.6/2.5 Turbo、Seedance 1.5 Pro、MiniMax Hailuo 2.3 等模型,支持 480P-1080P 输出,时长 5-15 秒。
高级特性包括:AI 提示词优化(--optimize)、负面提示词过滤(--negative_prompt)、本地/远程图片自动上传、自动轮询与断点续传、跨平台自动打开输出文件。
显著优点
- 模型覆盖全面:整合阿里、快手、字节、MiniMax 等厂商最新模型,避免用户多平台注册
- 成本透明可控:按 credits 计费,Qwen Image 系列 1 credit/张,Seedream 4 credits/张,视频 20-180 credits,支持快速迭代
- 输出质量高:支持 4K 图像与 1080P 视频,无水印下载(平台可用时)
- 工程化体验:纯 Python3 标准库实现,零依赖;自动化轮询、错误重试、结果下载一站式完成
- 中文优化:通义万相系列针对中文提示词与东方美学有专门优化
潜在缺点与局限性
- 平台依赖风险:Wuli.art 为第三方聚合平台,API 稳定性、模型可用性、定价策略受平台控制,存在服务变更风险
- 内容审核限制:内置中文敏感词过滤,历史、政治、人物肖像等题材可能触发 REVIEW_FAILED
- 成本累积:高质量模型(Seedream 4.5、可灵 2.6)单价较高,批量生成或长视频成本显著
- 视频时长受限:最长 15 秒,无法满足完整短片创作需求
- 无本地推理:所有计算云端完成,依赖网络质量,无法离线使用
适合人群
- AI 艺术创作者与设计师:需快速验证概念、批量生成素材
- 内容运营与社媒从业者:制作封面、配图、短视频片段
- 开发者与技术用户:习惯命令行工具,需将 AI 生成集成到自动化工作流
- 中文语境创作者:通义万相、可灵等模型对中文提示词理解更精准
常规风险
- API Token 泄露:Token 以 Bearer 方式传输,若硬编码或日志泄露可导致账户被盗刷 credits
- 版权与合规风险:生成内容的版权归属依平台条款,商用需确认授权;人物肖像生成需避免侵权
- 内容安全:提示词若触及敏感领域,可能导致账号受限
- 成本失控:未设置生成长度/数量上限时,误操作可能快速消耗 credits
建议:Token 存入环境变量或密钥管理工具;生产环境设置生成参数上限;定期审查平台服务条款更新。