Failover Gateway Pub

🔄 OpenClaw 高可用故障转移网关

OpenClaw 高可用故障转移方案,30秒自动切换主备节点,零脑裂设计,月成本$6-12,适合关键业务场景。

收藏
6k
安装
1.2k
版本
1.0.0
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

failover-gateway 是一套面向 OpenClaw 的主动-被动故障转移网关方案,通过部署备用节点实现高可用性。当主节点故障时,健康监控脚本在约30秒内自动将备用节点提升为主网关;主节点恢复后,备用节点自动降级回待机状态。

部署流程
1. 准备第二台VPS($6-12/月)作为备用节点

2. 配置 Tailscale 私有网络连接主备节点

3. 安装 OpenClaw 并启用单一通道(如 Discord DM)

4. 部署健康监控 systemd 服务

5. 在主节点禁用备用通道,实现通道隔离

关键设计:采用通道分割策略——主节点处理全量业务,备用节点仅保留最小可达通道(如仅接收 Discord 私信),彻底避免 split-brain 问题。

显著优点

| 优势 | 说明 |
|------|------|
| 快速切换 | ~30秒故障检测+自动提升 |
| 零配置恢复 | 主节点恢复后自动降级,无需人工介入 |
| 零脑裂风险 | 通道隔离设计,主备永不共享同一通道 |
| 低成本 | 仅需基础VPS + 免费 Tailscale |
| Git 同步 | 备用节点提升时自动拉取最新工作区 |
| 生产就绪 | 完整的 systemd 服务、日志监控、边缘 case 处理 |

潜在局限

  • 非热备:备用节点平时不运行网关,存在~60秒服务中断窗口
  • 单点备用:若主备同时故障,服务完全中断(需第三节点实现三副本)
  • 网络分区风险:极端网络分割场景下可能误判主节点状态,但通道隔离确保无冲突
  • 通道复杂度:需要为备用节点维护独立的 bot token 和通道配置
  • Tailscale 依赖:方案假设私有网络可用,公网直连需额外安全加固

适合人群

  • 运行关键业务 OpenClaw 实例的个人或团队
  • 需要灾难恢复能力但预算有限的用户
  • 已使用 Tailscale 或具备 VPN 管理经验的技术用户
  • 能接受~60秒 RTO(恢复时间目标)的场景

常规风险

1. 配置错误风险:若未禁用主节点上的备用通道,会导致 bot token 冲突("last-connect-wins")
2. Git 同步延迟:备用节点工作区版本取决于最后推送,频繁推送是必要的

3. 健康监控单点:监控脚本本身若崩溃,备用节点将失去故障感知能力

4. 成本累积:长期运行的备用 VPS 即使空闲也会产生费用

5. 测试盲区:未定期测试的故障转移方案可能在真实故障时失效,建议每月演练

技术可信度评估

方案基于成熟的 Linux 系统组件(systemd、bash、rsync、Git)和 Tailscale 网络层,架构清晰且有明确的故障时间线定义。但需注意:当前未提供 health-monitor.sh 完整源码审计,建议部署前审查监控脚本逻辑,特别是阈值判断和状态转换的边界条件。

Failover Gateway Pub 内容

scripts文件夹
手动下载zip · 6.1 kB
health-monitor.shtext/x-shellscript
请选择文件