核心用法
Stella Selfie 是一款面向AI数字角色的图像生成技能,通过多参考头像融合技术确保生成人物的高度一致性。用户可通过自然语言指令(如"发张自拍""展示你在咖啡馆的样子")触发,系统自动解析场景、服装、地点等关键词,智能选择「镜像自拍」(mirror) 或「直拍」(direct) 模式,调用 Google Gemini、fal.ai 或 laozhang.ai 等图像API生成照片,并通过 OpenClaw 网关发送至 Discord、Telegram、WhatsApp、Slack 等渠道。
关键工作流程:①解析用户指令提取场景/服装/分辨率/目标频道 → ②(可选)调用 timeline_resolve 获取角色当前状态(位置、活动、情绪、外观)以丰富提示词 → ③组装结构化英文提示词 → ④执行 Node.js 脚本生成图像 → ⑤发送至指定频道并确认结果。支持 1K/2K/4K 分辨率,默认可生成单张,可应要求生成多张。
显著优点
- 角色一致性保障:通过
Avatar主图 +AvatarsDir多参考图目录 +AvatarsURLs公开URL 三重机制,结合AvatarBlendEnabled融合算法,显著降低AI换脸漂移问题 - 智能模式选择:基于关键词(outfit/fashion → mirror; cafe/park/portrait → direct)和 timeline 连续性状态自动判断拍摄角度,无需用户记忆指令
- 多提供商弹性:原生支持 Google Gemini(默认)、fal(xAI Grok Imagine)、laozhang.ai(Gemini 格式代理),可根据配额、成本、地区合规性切换
- OpenClaw 原生集成:深度嵌入 OpenClaw 生态,自动读取 IDENTITY.md/SOUL.md 角色设定,支持 timeline 上下文联动,实现"角色状态→图像生成→渠道推送"闭环
- 安全网关设计:优先使用
openclaw message send本地通道,HTTP fallback 严格限制于 localhost/127.0.0.1/::1,禁止远程端点配置
潜在缺点与局限性
- 配置门槛较高:需预先准备 3-10 张同角色不同角度/服装的参考图,维护
IDENTITY.md和avatars/目录,对非技术用户不友好 - 提供商能力割裂:fal.ai 仅支持公开 URL 参考图,无法直接使用本地
AvatarsDir文件;laozhang.ai 需单独注册并配置计费模式 - timeline 依赖脆弱:若无显式场景关键词且 timeline_resolve 不可用,会降级为中性提示词,可能生成与角色当前叙事状态不符的图像
- 分辨率与成本权衡:4K 和 fal 提供商调用成本显著高于 Gemini 1K,高频使用需关注 API 配额消耗
- 生成后文件清理:Gemini/laozhang 模式下文件写入本地 workspace 后即时删除,失败保留策略可能导致隐私敏感图片残留调试目录
适合人群
- 运营AI虚拟角色账号的内容创作者(VTuber、AI网红、叙事角色账号)
- 需要角色形象一致性的 OpenClaw 深度用户,已具备 Node.js 环境和多图素材管理能力
- 对 Gemini/fal API 有配额储备,且熟悉环境变量配置的技术型用户
常规风险
- API 密钥泄露风险:
GEMINI_API_KEY、FAL_KEY、LAOZHANG_API_KEY以环境变量形式存储,需确保.env或容器 secret 管理合规,避免提交至代码仓库 - 参考图隐私暴露:
AvatarsURLs配置的公开 CDN 链接可能被反向追溯,真人照片外流风险;AvatarsDir本地文件在 laozhang 模式下会 base64 编码上传至第三方 API - 内容安全过滤:Gemini/fal 均内置NSFW/暴力/政治内容过滤,敏感场景提示词可能被拒绝,导致生成失败
- 渠道发送失败:OpenClaw Gateway Token 配置错误或频道权限不足时,图像生成成功但发送失败,需人工检查日志重试
- 版权与肖像争议:使用真人照片作为参考图生成虚拟形象,需确保拥有合法授权,避免肖像权纠纷