🫧 HappyHorse 1.0 — Pro Pack on RunComfy

🎬 Video Arena 第一的视频生成专家

创意与多媒体榜 #1

基于 RunComfy 平台的 HappyHorse 1.0 视频生成工具,集成当前 Video Arena 排名第一的文生视频模型,支持原生 1080p 与同步音频输出。

收藏
11.9k
安装
2.7k
版本
0.1.1
CLS 安全性认证2026-06-04
点击查看完整报告 >

使用说明

核心用法

HappyHorse 1.0 Pro Pack 是 RunComfy 平台托管的文生视频技能,调用当前在 Artificial Analysis Video Arena 盲评中排名第一(Elo 1333 t2v / 1392 i2v)的 HappyHorse 1.0 模型。用户通过本地 RunComfy CLI 执行 runcomfy run happyhorse/happyhorse-1-0/text-to-video,配合结构化 JSON 输入生成视频。

关键参数包括:

  • prompt:最多 2500 字符,支持中英日德法韩六种语言
  • aspect_ratio:16:9(默认)、9:16、1:1、4:3、3:4
  • resolution:720P 或 1080P(默认)
  • duration:3–15 秒(默认 5 秒)
  • watermark:布尔值控制平台水印

CLI 自动轮询任务状态至终端,完成后下载结果至指定目录。

显著优点

1. 质量领先:Artificial Analysis Video Arena 盲评第一,综合画质与运动表现最优
2. 原生 1080p + 同步音频:无需后期合成,单次生成即获带环境音/对白的完整视频

3. 多镜头角色一致性:跨镜头保持人物造型、服装连续性,适合品牌叙事

4. 多语言支持:6 种语言提示词直达模型,无需翻译链路

5. 专业提示词封装:内置经验证的提示模式(运动描述前置、镜头语言、音频方向),降低用户学习成本

潜在局限

  • 时长限制:单片段上限 15 秒,长叙事需分段生成后拼接
  • 画幅受限:仅 5 种固定比例,超宽 cinematic 画幅会被裁切或拒绝
  • 音频不可外导:无法传入外部音频驱动口型,需用 Wan 2.7 或 Seedance 2.0 Pro 实现
  • 无图生视频:此模板为纯文生视频,i2v 需调用独立管道
  • 平台依赖:必须持有 RunComfy 账户与有效 token,非自托管方案

适合人群

  • 需要快速产出高质量 1080p 视频内容的创作者与营销团队
  • 制作多语言短视频广告(TikTok/Reels/抖音)的跨境运营者
  • 追求角色一致性的品牌故事/IP 内容生产者
  • 希望原生音频减少后期工作流的效率型用户

常规风险

  • 账户计费:按 GPU 时长计费,生成失败不扣费但需关注 request_id 状态
  • Token 安全RUNCOMFY_TOKEN 环境变量或 ~/.config/runcomfy/token.json 需妥善保管
  • 输出大小:单文件下载上限 2 GiB,超长高清视频可能触发中断
  • 模型误路由:用户明确说 "HappyHorse" 时必须路由至此模型,不可擅自替换为 Wan/Seedance/LTX 等
  • Schema 严格:duration、aspect_ratio 超出枚举值将返回 422 错误

安全解读

核心用法

HappyHorse 1.0 Pro Pack 是 RunComfy 官方视频生成模型的结构化调用技能,通过封装最佳实践提示词模板与 API 参数规范,帮助用户获得优于普通提示的输出质量。

关键调用方式

  • 基础命令:runcomfy run happyhorse/happyhorse-1-0/text-to-video --input '{"prompt": "..."}' --output-dir <path>
  • 支持参数:prompt(2500字符,6语言)、aspect_ratio(5种预设)、resolution(720P/1080P)、duration(3-15秒)、seed、watermark
  • 自动轮询与下载:CLI 每2秒轮询状态,完成后自动下载视频至指定目录

提示词核心策略

  • 描述动态过程而非静态画面:"女人转身走向桌子,拿起杯子喝了一口"优于"喝咖啡的女人"
  • 镜头语言前置:"Wide shot." / "Tracking shot." / "35mm anamorphic"
  • 多镜头一致性:每个镜头重申锚定特征("same woman in red coat/blue scarf")
  • 音频同步:原生支持同生成 pass 的同步音频,可用 "warm friendly tone, English" 指定

模型路由决策

  • 多镜头角色/服装一致性 → HappyHorse 1.0(本技能)
  • 详细口型同步+参考视频 → Seedance 2.0 Pro
  • 精细运动控制+多参考条件 → Wan 2.7
  • 超快迭代(亚秒级每帧)→ LTX 2

显著优点

| 优势 | 说明 |
|------|------|
| 当前视频质量标杆 | Artificial Analysis Video Arena #1(Elo 1333 t2v / 1392 i2v) |
| 原生 1080p + 同步音频 | 同生成 pass 输出带对话/环境音/拟音的广播级视频 |
| 多镜头角色一致性 | 跨镜头保持角色外观与服装连续性 |
| 多语言原生支持 | 中/英/日/韩/德/法六语言提示,无质量衰减 |
| 来源可信 | RunComfy 为知名 ComfyUI 云服务平台,T2 可信组织 |

潜在缺点与局限性

  • 时长限制:15秒封顶,长叙事需分段生成后拼接
  • 画幅受限:仅支持 16:9、9:16、1:1、4:3、3:4 五种比例,超宽电影画幅会被裁剪或拒绝
  • 音频单向:仅支持文本描述生成音频,无法传入外部音频驱动口型(需转用 Wan 2.7 或 Seedance 2.0 Pro)
  • 无原生图生视频:本端点为纯文本生成,i2v 需调用 HappyHorse 独立管线
  • 成本敏感:720P 测试模式可降低成本,但 1080P 满配置生成费用较高

适合人群

  • 品牌内容创作者:需要多镜头一致性角色讲述品牌故事
  • 短视频制作方:快速产出带原生音频的竖屏/横屏内容
  • 多语言营销团队:无需翻译质量折损的全球化视频生产
  • AI 视频研究者:体验当前 SOTA 文本生成视频模型能力

常规风险

1. 账户依赖:必须持有 RunComfy 账户与有效 token,无离线使用能力
2. API 配额与计费:视频生成消耗 GPU 资源,需关注用量与账单

3. 提示词长度惩罚:超过 2500 字符会导致生成质量显著下降

4. 比例/时长越界:非支持画幅或 >15 秒会触发 422 错误

5. 网络稳定性:生成过程需持续连接,中断后需通过 CLI 取消避免计费

🫧 HappyHorse 1.0 — Pro Pack on RunComfy 内容

手动下载zip · 4.8 kB
SKILL.mdtext/markdown
请选择文件