核心用法
Video Generate Skill 调用豆包 Seedance 1.0/1.5 系列模型,实现多模态视频生成。支持三种核心输入模式:纯文本描述(Text-to-Video)、单帧/双帧图像引导(First/Last Frame)、以及融合参考图像、视频、音频的多模态生成。用户可通过 video_generate 函数批量提交任务,自定义分辨率(480p–1080p)、时长(2–12 秒)、画幅比例(16:9、9:16 等 8 种)及是否添加水印。Seedance 1.5 Pro 额外支持音频生成(generate_audio),实现声画同步输出。
显著优点
- 多模态灵活组合:最多 4 张参考图、3 段参考视频、3 段参考音频,支持风格迁移、人物替换、动作延续等复杂场景。
- 精准控制:首尾帧锁定实现平滑过渡,相机固定(
camera_fixed)与随机种子(seed)保障结果可复现。 - 生产级参数:最高 1080p 分辨率、289 帧(约 12 秒),满足短视频、广告素材及原型演示需求。
- 异步任务机制:内置轮询与任务查询接口,适配长时生成场景,避免阻塞。
潜在局限
- 时长上限:单视频最长 12 秒,长叙事需分段生成后后期拼接。
- 音频限制:仅 Seedance 1.5 Pro 支持音频生成,且需显式开启参数。
- 格式约束:参考视频/音频总时长 ≤15 秒,纯音频输入不被支持,必须搭配图像或视频。
- 环境依赖:需提前配置
ARK_API_KEY或同类密钥,密钥失效或模型未开通时需手动降级模型版本。
适合人群
短视频创作者、广告设计师、游戏/动画预演师、电商视觉运营及任何需快速将概念可视化的创意工作者。
常规风险
- 内容合规:生成视频需符合平台审核规范,避免敏感人物、暴力或侵权素材。
- 版权争议:参考图像/视频/音频若涉及第三方版权,商用前需确认授权。
- API 稳定性:模型版本迭代或密钥额度耗尽可能导致任务失败,建议生产环境配置降级模型与余额监控。