IMA AI Video Generator — Short & Promo Video, Text to Video, Image to Video Generation

🎬 10+ 顶尖模型一站式视频创作

聚合 Wan、Kling、Veo、Sora 等 10+ 主流 AI 视频模型,支持文生/图生/首尾帧/参考图模式,提供统一 API 接口与视觉一致性工作流。

收藏
3.1k
安装
1.4k
版本
1.0.10
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

IMA Studio Video Generation 是一个多模型聚合型 AI 视频生成工具,通过单一接口调用 Wan 2.6、Kling O1/2.6、Google Veo 3.1、Sora 2 Pro、Pixverse、Hailuo、SeeDance、Vidu 等十余个主流视频生成模型。支持四种任务类型:

  • text_to_video:纯文本提示生成视频
  • image_to_video:以图片作为首帧生成视频
  • reference_image_to_video:图片作为视觉参考(非首帧),保持风格/角色一致性
  • first_last_frame_to_video:双图首尾帧插值生成过渡视频

用户需配置 IMA_API_KEY,通过 Python 脚本提交任务,API 返回视频 HTTPS 直链。系统采用轮询机制(约 8 秒/次)查询任务状态,典型耗时 1–6 分钟,部分重模型(Kling O1、Sora Pro、Veo)可能更长。

显著优点

1. 模型覆盖全面:集成国内外第一梯队视频模型,无需分别注册多个平台账号
2. 统一接口规范:标准化的 model_id 体系与任务类型定义,降低多模型切换成本

3. 视觉一致性支持:通过 reference_image_to_video 模式及可选的 ima-knowledge-ai 扩展,实现跨镜头的角色/场景连续性

4. 灵活的输入方式:支持文本提示、图片 URL、本地图片自动上传(转为 URL)

5. 偏好记忆机制:用户显式选择的默认模型持久化存储于 ima_prefs.json

潜在缺点与局限性

1. 严格的内容合规:Sora 2 Pro 等模型对人物、名人、IP 相关内容限制严苛,实际可用场景受限
2. 模型 ID 复杂易错:同一模型的 t2v/i2v 版本往往有不同后缀(如 wan2.6-t2v vs wan2.6-i2v),需严格对照表格使用

3. 异步轮询开销:用户需自行实现 8 秒间隔的轮询逻辑,集成复杂度高于同步 API

4. 积分/计费不透明:文档仅提及 "credits" 概念,未公开各模型具体定价

5. 依赖第三方上传域:图片上传需走 imapi.liveme.com,存在额外的域名信任与稳定性考量

适合人群

  • 短视频创作者、广告制作团队:需要快速对比多模型效果,选择最优输出
  • 开发者/AI 应用构建者:希望以统一接口集成视频生成能力,避免维护多平台 SDK
  • 视觉叙事工作者:需要保持角色连续性的分镜制作、系列内容创作

常规风险

  • API 密钥泄露风险IMA_API_KEY 为 Bearer Token 形式,需妥善保管,避免硬编码
  • 内容审核不可控:不同模型的安全策略差异大,Sora 等可能无理由拒绝生成,需准备备选模型
  • 数据留存与隐私:图片上传至 imapi.liveme.com,敏感素材需评估第三方托管风险
  • 长时任务超时:重模型任务可能接近 40 分钟上限,需设置合理的客户端超时与重试策略
  • 日志自动清理:运行日志 7 天后自动删除,重要信息需自行归档

IMA AI Video Generator — Short & Promo Video, Text to Video, Image to Video Generation 内容

scripts文件夹
手动下载zip · 49.3 kB
ima_logger.pytext/plain
请选择文件