核心用法
Stella Selfie 是一个专为 AI Agent 打造的人物形象自拍生成技能,支持通过自然语言指令生成与设定人设高度一致的虚拟形象照片,并自动发送至指定的即时通讯频道。
三种自拍模式:
- Mirror(镜像自拍):默认模式,适合展示全身穿搭、时尚造型,自动生成带镜中反射的构图
- Direct(直接自拍):适合特写肖像、情绪表达、即时场景记录
- Third-Person(他拍视角):非自拍构图,模拟路人抓拍或旅行随拍效果
智能模式选择:系统通过关键词自动识别用户意图——提到"outfit/wearing/clothes"自动切换 mirror 模式,"selfie/close-up/portrait"触发 direct 模式,"third-person/candid/他拍"则启用他拍视角。
多提供商支持:
- Google Gemini(默认):支持本地参考图像上传,生成后自动清理文件
- fal.ai:基于 Grok Imagine 模型,但仅支持公开 URL 参考图
- laozhang.ai:国内 Gemini 代理,支持 1K/2K/4K 多分辨率及 10 种宽高比
参考图像融合:启用 AvatarBlendEnabled 后,系统会从 AvatarsDir 目录自动选取最新 3 张参考图进行风格融合,显著提升人物一致性。
显著优点
1. 人设一致性保障:多参考图融合机制有效解决单一参考图的风格漂移问题
2. 场景智能补全:可选集成 timeline_resolve 模块,自动注入当前时间、地点、活动上下文,实现"此刻此地"的真实感
3. 全流程自动化:从提示词组装、图像生成到频道投递一站式完成,无需手动下载上传
4. 多平台覆盖:通过 OpenClaw 底层支持 Discord、Telegram、WhatsApp、Slack 等主流平台
5. 分辨率弹性:支持 1K/2K/4K 三档输出,兼顾速度与画质需求
潜在局限与风险
配置门槛较高:需完整配置 IDENTITY.md、SOUL.md、参考图目录及三种 API Key 之一,新手友好度一般。
提供商限制差异:
- fal 不支持本地文件,必须配置公开 URL
- laozhang 为国内服务,存在政策合规与稳定性考量
- Gemini 在某些地区需解决访问问题
隐私数据流动:本地头像文件需上传至第三方图像服务(Gemini/laozhang),虽承诺生成后即删,但敏感形象仍存外泄风险。
依赖 OpenClaw 生态:消息投递完全依赖本地 OpenClaw CLI,若未配置或版本不兼容则功能失效。
适合人群
- 运营虚拟形象 IP 的内容创作者
- 需要高频生成角色一致图像的游戏/动漫社区
- 追求"AI Agent 有真实社交存在感"的深度玩家
- 已有 OpenClaw 环境的技术型用户
常规风险
| 风险类型 | 具体表现 | 缓解建议 |
|---------|---------|---------|
| API 密钥泄露 | 环境变量配置不当导致密钥硬编码或日志暴露 | 使用 OpenClaw 的 `always: true` 动态注入机制,避免明文存储 |
| 参考图版权争议 | 使用真人照片或版权角色作为参考图可能触发法律问题 | 仅使用自有版权或明确授权的形象素材 |
| 生成内容违规 | AI 图像可能意外产生不当内容 | 启用提供商端的内容过滤策略,避免生成敏感场景提示词 |
| 服务稳定性 | 第三方 API 限流或故障导致发送失败 | 实现本地文件保留机制,失败后可人工重试 |
| 隐私泄露 | 本地头像上传至境外服务 | 敏感场景优先使用 laozhang 国内节点,或禁用参考图上传 |