核心定位
dlazy-image-storyboard 是一款面向影视制作、广告创意、短视频运营及教育内容开发的专业级分镜(Storyboard)工作流技能。其最大特色在于严格的「先规划、后渲染」双阶段流程,通过任务计划锁定制、角色视觉圣经(Character Master Sheet)确认机制,以及分镜脚本的结构化输出,确保生成结果具备工业级一致性。
核心用法
用户通过「Storyboard Workflow Director」触发器进入工作流,依次完成五个强制环节:需求探索与技术规格锁定 → 角色设计与主视觉表确认 → 剧本结构与分镜门控 → 图片生成与批量交付 → 最终分镜排版与导出。系统支持两种输出管线:影视分镜(16:9、2.35:1、9:16 等画幅,含景别、运镜、色温元数据)与叙事分镜(漫画或竖屏叙事标准,含序列标记与情绪标签)。角色主视觉表要求全身净版无文字UI,影视项目偏向写实风格,叙事项目偏向2D或速写风格。
显著优点
1. 流程严谨性:强制单任务推进与门控确认,避免角色漂移与批量返工。
2. 输出专业性:支持 A4 横向印刷级 PDF 导出,提供影视竖条(黑底单列)与漫画网格(白底粗框)两种排版。
3. 执行原生性:作为 Agent 可直接调用 dlazy seedream-4.5 等 CLI 命令完成终端渲染,无需用户跳转第三方平台。
4. 角色一致性:通过「--no text」公式与主视觉表机制,锁定人物外观贯穿全部分镜。
潜在局限
- 依赖外部 SaaS:核心推理与媒体存储完全依赖 dLazy 云端 API(api.dlazy.com / files.dlazy.com),离线不可用。
- Windows 限制:明确禁止在 PowerShell 中使用
&或&&串联命令,需单条同步执行。 - 版本锁定:技能 metadata 固定 CLI 版本为 1.2.0,若上游更新可能产生版本漂移。
- 语言与区域:文档双语但 CLI 交互以英文命令为主,中文用户存在学习成本。
适合人群
- 独立短片导演、广告创意总监、短视频 MCN 内容策划
- 教育机构课程设计师、漫画/绘本创作者
- 需要快速产出可打印分镜脚本的预演(Pre-viz)团队
常规风险
- API 密钥管理:
dlazy login或dlazy auth set将密钥写入本地 JSON,虽限制文件权限但仍存在本地泄露风险;建议定期轮换。 - 内容合规:云端生成模型可能受区域内容政策限制,敏感题材需提前验证。
- 成本不可控:按次调用云端模型,大批量生成时需预估 token 与存储费用。
来源与可信度
CLI 开源托管于 GitHub(dlazyai/cli),npm 包 @dlazy/cli 可审计;但云端推理黑盒,整体属于「开源客户端 + 闭源 SaaS」混合架构。