核心功能
HARPA Grid 是一项基于 REST API 的浏览器自动化服务,允许用户远程操控真实 Chrome 浏览器实例完成复杂网页任务。核心能力涵盖四大场景:
1. 智能网页抓取(Scrape)
支持完整页面转 Markdown,或通过 CSS/XPath/文本选择器精准提取结构化数据。grab 数组语法允许单次请求抓取多组字段,输出带标签的 JSON 格式。
2. 搜索引擎集成(SERP)
内置搜索能力,支持 site:、intitle: 等高级运算符,直接返回搜索结果页结构化数据。
3. AI 命令执行(Command)
调用 100+ 内置 HARPA 命令或自定义自动化流程,如智能摘要、数据提取、表单处理等。支持 GPT-4o、Claude 3.5 Sonnet 等多模型切换。
4. 上下文感知提示(Prompt)
通过 {{page}} 变量将完整页面内容注入 AI 提示词,实现针对当前网页的智能分析、信息抽取与内容生成。
显著优势
- 真实浏览器环境:运行于用户本地 Chrome 扩展,继承登录态、Cookie 与动态渲染能力,轻松穿透反爬机制
- 节点弹性调度:支持单节点、多节点、广播(
*)及自动负载均衡(数字语法),适合批量任务分发 - 异步 webhook:最长 30 天任务存活期,节点离线时可排队恢复,配合回调机制实现高可靠流水线
- 零基础设施:无需自建浏览器集群或代理池,API 即开即用
局限与风险
- 前置依赖重:必须安装 Chrome 扩展、保持至少一个活跃节点、获取 API Key,本地配置门槛较高
- 单点可靠性:任务执行依赖用户本地浏览器状态,节点崩溃或网络中断会导致任务失败(虽有 webhook 缓冲)
- 成本不透明:文档未披露定价模型,高频调用可能产生不可预期费用
- 数据隐私:页面内容需上传至 HARPA 云服务处理,敏感信息存在第三方暴露风险
- 超时限制:最大 5 分钟,复杂 AI 分析可能被迫中断
适用人群
- 需绕过传统反爬、处理动态渲染页面的数据工程师
- 构建 AI 驱动浏览器自动化工作流的技术团队
- 希望快速原型验证,不愿投入浏览器集群运维成本的中小开发者
安全建议
API Key 应通过环境变量注入,避免硬编码;生产环境建议使用专用节点并监控 webhook 回调完整性,对敏感业务数据启用本地预处理脱敏。