核心功能
Stella Selfie 是一款专为AI Agent设计的角色一致性自拍生成系统,核心能力包括:
1. 智能语境理解:自动识别用户指令中的场景、服装、地点、情绪等关键词,结合时间线上下文(timeline)推断当前状态
2. 双模式自拍:mirror(镜面全身)与 direct(直面镜头)两种构图模式,根据活动连续性智能切换
3. 多参考图像融合:支持本地文件夹(avatars/)或公开URL多图 blending,确保角色外貌高度一致
4. 三引擎可选:Google Gemini(默认)、fal(xAI Grok Imagine)、laozhang.ai(国内Gemini代理)
5. OpenClaw 原生集成:生成后直接推送至 Discord、Telegram、Slack、WhatsApp 等任意频道
显著优点
- 角色一致性极强:
AvatarBlendEnabled多图融合有效避免单图参考导致的形象漂移 - 零配置开箱:默认 Gemini 免部署,安装即可用
- 语境感知生成:自动调用
timeline_resolve获取当前活动、地点、情绪,告别"凭空捏造" - 分辨率弹性:1K/2K/4K 按需选择
- 安全清理机制:Gemini 生成文件发送后自动删除本地缓存
潜在局限与风险
| 风险点 | 说明 |
|--------|------|
| **第三方API依赖** | Gemini、fal、laozhang.ai 任一服务中断即影响可用性 |
| **fal 本地文件限制** | fal 仅接受公开URL,本地 `Avatar`/`AvatarsDir` 无效,需额外配置CDN |
| **隐私传输** | laozhang.ai 模式下本地头像会被 base64 编码上传至第三方服务器;Gemini 直接上传原图 |
| **时间线依赖** | 若未配置 timeline 系统,智能语境推断降级为关键词匹配,体验打折扣 |
| **HTTP回退限制** | `OPENCLAW_GATEWAY_URL` 严格限定 localhost,无法直连远程端点 |
适合人群
- 运营虚拟角色账号的创作者(VTuber、AI网红、品牌人格化账号)
- 需要AI Agent具备"视觉存在感"的聊天机器人开发者
- 多平台矩阵运营者(需同步推送Discord/Telegram/WhatsApp)
常规风险管控建议
1. 敏感头像本地化处理:避免在 AvatarsURLs 中放置含个人隐私的未公开链接
2. API密钥分级管理:生产环境建议使用专用 Gemini/FAL key,勿复用个人账号
3. 定期清理 `~/.openclaw/workspace/stella-selfie/`:即使自动删除机制失效也可手动兜底
4. laozhang.ai 用户必配置计费模式:token 默认无计费策略,需先在后台启用