核心用法
IMA Nano Banana 是专为即时通讯场景设计的图像生成技能,调用 IMA Open API 的 Nano Banana 系列模型(Nano Banana 2 / Nano Banana Pro)完成文生图与图生图任务。用户通过自然语言指令触发,系统根据输入自动识别任务类型:纯文本输入触发 text_to_image,单张图片配合编辑指令触发 image_to_image。
模型选择采用三级策略:用户偏好记忆 > 任务类型默认 > 实时推荐。Nano Banana 2(gemini-3.1-flash-image)为平衡默认,支持 512px/1K/2K/4K 四档分辨率,积分消耗 4–13 点;Nano Banana Pro(gemini-3-pro-image)定位高质量,1K/2K/4K 输出,10–18 积分。原生支持 1:1、16:9、9:16、4:3、3:4 五种宽高比,无需后期裁剪。
交互流程遵循 6 步 UX 协议:Step 0 友好确认 → Step 1 预生成通知(模型/耗时/积分透明化)→ Step 2 进度推送(20 秒以上任务)→ Step 3 成功回图(渲染图片+元数据)→ Step 4 失败降级(备选模型建议)→ Step 5 静默结束。全程避免暴露脚本名、API 参数等技术细节。
显著优点
- 成本梯度精细:从 4 积分 512px 快速草图到 18 积分 4K 精稿,覆盖预算至高端全场景
- 原生比例支持:1:1、16:9、9:16、4:3、3:4 直接输出,告别黑边或拉伸
- 即时反馈机制:20–40 秒(Nano Banana 2)到 60–120 秒(Nano Banana Pro)预估时长,配合进度推送降低等待焦虑
- 偏好记忆:
~/.openclaw/memory/ima_prefs.json保存用户模型偏好,实现个性化默认 - 图生图完整链路:内置图片上传至 CDN 流程,支持风格迁移、重绘等编辑场景
潜在缺点与局限性
- 模型生态封闭:仅支持 Nano Banana 系列,无法调用 SeeDream、Midjourney 等外部模型
- 分辨率天花板:最高 4K,8K 需求需降级处理并告知用户
- 积分预扣机制:任务创建即冻结积分,失败不返还,高频失败场景可能造成积分损耗
- 网络依赖双域:
api.imastudio.com与imapi.liveme.com均需稳定连接,后者用于图生图上传 - 错误码映射复杂:6006、6010、4008 等错误需人工转译为自然语言,调试成本较高
适合人群
- 社交媒体运营者:快速产出 9:16 竖图、1:1 方图等标准比例素材
- 电商卖家:低成本生成产品场景图(Nano Banana 2 512px 4 积分批量试水)
- 设计师/插画师:Nano Banana Pro 4K 输出用于精稿或概念验证
- 普通用户:自然语言指令即可,无需学习 Prompt 工程
常规风险
| 风险类别 | 描述 | 缓解措施 |
|---------|------|---------|
| API 密钥泄露 | 密钥需配置于环境变量,图生图场景会发送至双域 | 使用 scope 受限的测试密钥,禁止 hardcode |
| 积分盗刷 | 密钥泄露可能导致恶意高分辨率任务 | 定期轮换密钥,监控积分消耗异常 |
| 本地数据残留 | 偏好文件与日志存于 `~/.openclaw/` | 手动删除 `ima_prefs.json`,日志 7 天自动清理 |
| 模型输出合规 | 未内置内容过滤,用户需自行遵守 IMA 平台条款 | 避免生成敏感、侵权内容 |
| 服务可用性 | 依赖 IMA Studio 基础设施 | 关注官方状态页,失败时自动降级备选模型 |