核心用法
Stella Selfie 是一款专为 AI Agent 设计的图像生成技能,可将文本描述转化为角色高度一致的自拍图片并自动推送至目标通讯频道。用户只需说出"发张自拍"或"send me a photo"等自然语言指令,系统即可自动解析场景、服装、构图模式等意图,调用 Google Gemini、fal(xAI Grok Imagine)或 laozhang.ai 等主流图像模型完成生成。
技能内置三种智能构图模式:Mirror Selfie(镜面自拍,适合全身/穿搭展示)、Direct Selfie(直拍自拍,适合面部特写)、Third-Person Photo(他拍视角,适合旅拍/抓拍场景)。系统通过关键词自动识别用户意图,无需手动指定。支持 1K/2K/4K 多档分辨率,可批量生成多张图片。
显著优点
1. 角色一致性保障:支持多参考头像融合(AvatarBlend),从本地图库或公开 URL 选取最多 3 张参考图,确保生成人物与设定形象高度一致
2. 多供应商灵活切换:原生支持 Gemini、fal、laozhang.ai 三大平台,用户可根据网络环境、成本预算自由切换
3. 稀疏请求智能补全:对于"想看看你"等模糊指令,可结合时间线上下文自动推断场景,降低用户表达成本
4. OpenClaw 生态深度集成:与消息通道无缝对接,支持 Discord、Telegram、WhatsApp、Slack 等平台一键投递
潜在局限与风险
- 配置门槛较高:需预先准备 IDENTITY.md、SOUL.md 及参考图库,初次部署涉及多文件配置
- 供应商依赖风险:Gemini 需上传本地图片至 Google 服务器,存在数据出境合规考量;fal 仅支持公开 URL 作为参考,本地文件无法直接使用
- 生成质量波动:AI 图像生成存在随机性,复杂场景或小众风格可能出现面部崩坏、肢体异常等问题
- 隐私泄露隐患:本地头像文件在 laozhang.ai 模式下需 base64 编码上传,虽传输加密但仍涉及第三方数据流转
适合人群
- 运营虚拟 IP、AI 数字人的创作者与机构
- 需要将 AI Agent 形象化、人格化的开发者
- 多平台社群运营者,追求高效内容生产与一致视觉输出
- 对角色一致性有严格要求的游戏、动漫、Vtuber 从业者
常规风险提示
首次使用前务必完成身份配置与图库准备,建议在私密频道测试后再投入生产环境。敏感场景生成请优先使用本地部署方案,谨慎评估第三方云服务的合规边界。