Translate Image

🌐 AI图像翻译与文字智能处理专家

AI驱动的图像翻译与OCR工具,支持多语言漫画翻译、智能文字移除,集成Gemini等前沿大模型,适合漫画阅读、文档处理与图像修复。

收藏
3.4k
安装
1.2k
版本
1.0.2
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

TranslateImage 是一款专注于图像文字处理的 AI 工具,通过 REST API 提供四大核心能力:

1. 图像翻译 (/api/translate):识别图像中的文字并翻译为目标语言,同时保留原始视觉布局,支持漫画字体定制(WildWords、BadComic 等),返回翻译后的图像与文本区域信息。

2. OCR 文字提取 (/api/ocr):高精度提取图像文字,输出带置信度与边界框的结构化数据,适合文档扫描、路牌识别等场景。

3. 智能文字移除 (/api/remove-text):基于 AI 图像修复技术,自动检测并清除水印、字幕、注释等文字,生成干净背景。

4. AI OCR + 翻译 (/api/image-to-text):结合 Gemini 模型的高阶文字识别,支持一键多语言翻译,适合复杂排版或低质量图像。

显著优点

  • 多模型支持:可选 Gemini 2.5 Flash、DeepSeek、Grok-4、Kimi K2、GPT-5.1 等翻译引擎,灵活平衡速度与质量
  • 专业漫画支持:内置漫画专用字体与布局保持算法,对竖排、拟声词等复杂排版优化良好
  • 一站式服务:翻译、OCR、修图三合一,减少工具切换
  • 多平台兼容:支持 macOS、Linux、Windows,通过 curl 即可调用

潜在缺点与局限性

  • 付费依赖:完全基于云端 API,需持续购买积分,无离线能力
  • 修复质量波动:复杂纹理背景的文字移除可能出现修复痕迹
  • 大文件延迟:5MB 以上图像处理时间显著增加
  • API 权限细分:不同功能需单独申请 scope,配置门槛较高

适合人群

  • 漫画/轻小说爱好者(日漫、韩漫、国漫翻译)
  • 跨境电商运营(产品标签翻译)
  • 设计师与内容创作者(去水印、素材清理)
  • 翻译工作者与多语言文档处理用户

常规风险

  • 数据隐私:图像需上传至第三方服务器,敏感文档存在泄露风险
  • 翻译准确性:AI 翻译对文化梗、双关语处理可能生硬
  • 服务稳定性:依赖单一服务商,API 中断或计费变更影响使用
  • 成本不可控:按量计费模式下高频使用可能产生较高费用

Translate Image 内容

scripts文件夹
手动下载zip · 7.1 kB
validate.jstext/javascript
请选择文件