核心用法
该 skill 是一套自动化工作流,通过 Chrome DevTools MCP 工具远程控制已登录 Google 账号的 Chrome 浏览器,在 Gemini 网页端完成图片生成、下载及水印去除的全流程。
执行流程:启动远程调试 Chrome → 打开 Gemini 页面 → 点击「制作图片」→ 输入视觉 prompt(避免"唱""弹"等音乐触发词)→ 等待生成 → 下载完整尺寸图片 → 使用 GeminiWatermarkTool 去除水印。
显著优点
1. 零 API 成本:直接利用 Gemini 网页端免费生图能力,无需付费 API
2. 完整分辨率:可下载原始尺寸图片,非预览压缩版
3. 自动化整合:将浏览器操控、文件系统操作、命令行工具串联为单一工作流
4. 水印可去除:配套开源工具可彻底清理 Gemini 浮水印
潜在缺点与局限性
- 依赖 GUI 稳定性:基于 DOM 元素定位,Gemini 界面改版会导致脚本失效
- 环境配置复杂:需同时维护 Chrome 远程调试、Google 登录状态、MCP 服务
- 非官方通路:使用 DevTools 协议模拟用户操作,存在服务条款风险
- 生成速度受限:Gemini Nano 模型响应较慢,单次流程可能耗时数十秒
- 地域限制:Gemini 服务在部分国家/地区不可用
适合人群
- 需要批量生成无版权顾虑配图的内容创作者
- 希望自动化 Gemini 生图流程的开发者/运维人员
- 已有 MCP 环境、熟悉 Chrome DevTools 协议的自动化工程师
常规风险
- 账号安全:远程调试端口暴露、Google 账号凭证需妥善保管
- 服务可用性:依赖 Google 网页服务,界面变更即需维护脚本
- 合规争议:自动化工具绕过网页正常交互,可能违反 ToS
- 水印工具:第三方二进制工具需审计源码或信任发布方