Agent Selfie

🤳 AI 智能体专属头像工坊

creative榜 #22

基于 Gemini API 的 AI 智能体头像生成器,支持情绪主题、季节风格和自动风格进化,快速创建个性化虚拟形象。

收藏
10.3k
安装
3.4k
版本
1.0.0
CLS 安全性认证2026-06-23
点击查看完整报告 >

使用说明

核心用法

agent-selfie 是一款面向 AI Agent 和开发者的自画像生成工具,通过调用 Google Gemini 的图像生成 API,基于预设的人格配置(personality)、情绪(mood)和主题(theme)自动生成头像、横幅或全尺寸图片。核心交互通过命令行完成,支持 JSON 内联或文件形式定义角色形象,输出格式涵盖 1:1 头像(avatar)、16:9 横幅(banner)及竖版全图(full),适配 Discord、Twitter/X、AgentGram 等多平台头像需求。

显著优点

1. 低门槛高灵活:仅需 GEMINI_API_KEY 和 Python3,无需复杂部署;人格配置极简(name/style/vibe 三字段),即可生成风格一致的系列形象。
2. 情绪与季节联动:内置 8 种情绪(happy/focused/creative 等)和 8 种季节主题(四季+节日),支持自动风格演化,适合长期运营的 Agent 形象迭代。

3. 批量与自动化友好:支持 --count 批量生成,可结合 Cron 定时任务实现每日自动更新头像,满足社交媒体自动化运营场景。

4. 多平台即插即用:明确给出 Discord、Twitter/X、AgentGram 的尺寸适配建议,降低跨平台部署成本。

潜在缺点与局限性

  • 强依赖 Gemini API:服务可用性、定价策略及地域限制完全受 Google 制约;HTTP 429/5xx 错误提示需手动重试,无自动熔断机制。
  • 生成结果不可控:API 返回"No image in response"时需简化 prompt,缺乏本地调试或预览能力,迭代成本较高。
  • 安全与合规空白:代码仓库未提及内容过滤(如 NSFW 检测)、版权归属声明,亦未见 API 密钥的安全存储指引(仅环境变量暴露)。
  • 生态单一:仅支持 Gemini,未开放 Stable Diffusion、Midjourney 等替代后端, vendor lock-in 风险明显。

适合人群

  • AI Agent 开发者需快速为 Bot 创建视觉身份
  • 社交媒体自动化运营者追求头像"日更"新鲜感
  • 虚拟主播/数字人项目需要低成本批量素材原型

常规风险

  • 密钥泄露风险GEMINI_API_KEY 以明文环境变量传递,共享环境或 CI/CD 日志中易暴露。
  • API 成本不可控:批量生成无预算上限设置,高频率任务可能产生意外账单。
  • 内容政策风险:Gemini 生成内容受 Google 使用条款约束,政治、医疗等敏感领域可能触发审核导致生成失败。

安全解读

核心用法

agent-selfie 是一款专为 AI 智能体(Agent)设计的视觉身份生成工具,通过调用 Google Gemini 图像生成 API,为虚拟角色、聊天机器人、社交媒体账号等创建专属头像、横幅和故事风格图片。

基础命令结构

python3 scripts/selfie.py --personality '{"name":"xxx","style":"xxx","vibe":"xxx"}' --format avatar --mood happy --theme spring

核心功能包括:

  • 人格化配置:通过 JSON 定义智能体名称、视觉风格(style)和性格气质(vibe)
  • 情绪与主题系统:8 种预设情绪(happy/focused/creative/chill 等)+ 8 种季节/节日主题
  • 多格式输出:avatar(1:1 头像)、banner(16:9 横幅)、full(9:16 故事/竖版)
  • 批量生成:支持 --count N 一次性生成多张图片
  • 自动化集成:提供 Cron 示例,支持定时自动生成新头像

典型应用场景:Discord/Twitter 机器人头像、AI 助手视觉形象、社交媒体账号品牌标识、虚拟主播角色设定等。

显著优点

1. 极致轻量安全:纯 Python 标准库实现(urllib/json/pathlib/argparse),零第三方依赖,彻底消除供应链攻击风险
2. 单一可信 API:仅调用 Google 官方 Gemini API(generativelanguage.googleapis.com),HTTPS/TLS 1.3 加密传输

3. 安全凭证管理:API 密钥通过 GEMINI_API_KEY 环境变量传入,无硬编码敏感信息

4. 受限文件访问:仅写入用户指定的 --out-dir 目录,无系统敏感路径访问

5. 来源完全透明:GitHub 开源(MIT 许可证),代码仅 287 行,可审计性强

6. 平台适配完善:内置 Discord、Twitter/X、AgentGram 等平台的分辨率与使用建议

潜在缺点与局限性

  • 依赖外部云服务:图像生成完全依赖 Google Gemini API,离线不可用,存在服务商稳定性依赖
  • API 配额与成本:受 Gemini API 调用配额限制,高频使用可能触发速率限制或产生费用
  • 来源可信度一般:T3 级别(个人开发者维护),长期维护连续性需持续关注
  • 功能边界明确:专注静态图片生成,不支持动态图像、视频或 3D 模型
  • 无内置缓存机制:相同参数重复调用会重复消耗 API 配额

适合人群

  • AI 开发者:为聊天机器人、智能助手快速创建视觉形象
  • 社区运营者:Discord/Telegram/微信群机器人的头像设计
  • 虚拟身份创作者:虚拟主播、AI 角色、社交媒体账号的品牌视觉搭建
  • 技术爱好者:学习 Gemini API 图像生成、安全 Python 编程实践的参考项目

常规风险

  • API 密钥泄露风险:若环境变量设置不当或在共享终端执行,可能导致密钥暴露
  • 输出目录权限问题:若指定系统敏感路径可能引发权限错误,建议始终使用专用输出目录
  • 内容生成不可控:Gemini API 生成图像的内容由 Google 模型决定,存在输出不可预测性
  • 个人维护风险:项目由个人开发者维护,更新频率和安全响应速度可能不及企业级项目
  • 服务依赖风险:Google API 政策调整、地区限制或账号封禁可能影响服务可用性

Agent Selfie 内容

scripts文件夹
手动下载zip · 7.2 kB
selfie.pytext/plain
请选择文件