核心用法
HitPaw Image & Video Enhancer 是一款基于 OpenClaw 框架的 CLI 工具,通过调用 HitPaw 官方 API 实现专业级 AI 图像与视频增强。该技能提供两大核心命令:
- `enhance-image`:支持 10 余种图像模型,涵盖通用超分(2x/4x)、人像美化/自然修复、高保真放大、降噪锐化及生成式重建(基于 Stable Diffusion)
- `enhance-video`:支持 6 种视频模型,包括通用修复、人像稳定修复、Ultra HD 4K 放大及生成式视频重建
配置简单,仅需设置 HITPAW_API_KEY 环境变量即可调用。支持自定义 DPI、EXIF 保留、音频保留、轮询间隔及超时设置等高级参数。
显著优点
1. 工业级输出质量:基于 HitPaw 自研 AI 模型,采用深度卷积与特征学习技术,输出可达广播级/商业摄影标准
2. 模型生态完整:16+ 专业模型覆盖从通用风景、人像美化到极端退化内容的生成式重建,场景适配性极强
3. 时序稳定性:视频模型专门优化多帧一致性,消除闪烁与抖动,保持身份连贯性
4. 高保真优先:标准模型严格保留原始细节与主体身份,避免过度处理导致的失真
5. 灵活的工作流:CLI 设计支持批量处理脚本集成,输出格式支持 JPG/PNG/WEBP(图像)及 MP4/MOV/AVI(视频)
潜在缺点与局限性
1. 云服务依赖:所有处理均需上传至 HitPaw 云端,涉及数据隐私考量;不支持本地离线处理
2. Token 消耗成本:按量计费(图像 50-100+ coins,视频 150-400 coins/分钟),大规模处理成本较高
3. 视频时长限制:单视频最长 1 小时,输出分辨率上限 36MP(约 7680×4320)
4. 输入源限制:视频需通过公开 URL 访问,不支持直接本地文件上传(需自行托管)
5. 生成式模型无 DPI 元数据:generative_* 系列模型不支持 DPI 注入,专业印刷场景需注意
6. 非官方集成免责声明:Skill 作者明确声明此为非官方集成,HitPaw 服务条款变更可能导致兼容性问题
适合人群
- 商业摄影师/修图师:需要批量高保真放大、降噪、人像精修
- 档案/博物馆数字化工作者:老照片、历史影像的修复与超分辨率重建
- 视频制作/后期团队:SD 素材转 4K、老家庭录像修复、访谈节目人像美化
- AI 工作流开发者:需将图像/视频增强集成至自动化 pipeline 的技术用户
常规风险
| 风险类型 | 说明 |
|---------|------|
| **数据隐私** | 原始素材需上传至第三方云端(`api-base.hitpaw.com`),敏感内容需谨慎评估 |
| **成本失控** | 视频处理按分钟计费,长视频或高分辨率任务费用累积快,建议预先估算 |
| **API 可用性** | 依赖 HitPaw 服务稳定性,存在 rate limit、服务中断或定价策略变更风险 |
| **输出不确定性** | 生成式模型(`generative_*`)可能产生与预期不符的细节"想象",需人工审核 |
| **许可合规** | 需自行确保输入素材版权合规,输出内容受 HitPaw 服务条款约束 |