Nexus Safe

🛡️ 零网络本地运维 受控安全恢复

本地自治SRE智能体,提供零网络依赖的系统监控与受控恢复,需显式授权方可执行重启操作,适合高安全要求的运维场景。

收藏
2k
安装
985
版本
0.1.5
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

Nexus-Safe 是一款面向本地环境的自主站点可靠性工程(SRE)代理,专注于系统监控与受控故障恢复。其设计理念以"安全优先"为核心,通过多层环境变量控制实现细粒度的操作权限管理。

基础监控流程

  • 使用 /nexus-safe status 获取系统整体健康状态,包括CPU、内存、磁盘等关键指标及服务运行列表
  • 使用 /nexus-safe logs <target> 强制获取目标服务的最新日志,此为任何恢复操作的前置条件

恢复操作机制

  • 恢复功能默认禁用,需显式设置 NEXUS_SAFE_ALLOW_RESTARTS=true
  • 即使授权后,重启操作仍被严格限制在预定义白名单内:
  • Docker服务白名单:NEXUS_SAFE_ALLOWED_DOCKER
  • PM2进程白名单:NEXUS_SAFE_ALLOWED_PM2
  • 通过 NEXUS_SAFE_MAX_RESTARTS(默认3次)防止重启风暴

技术依赖:Python的psutil库,系统PATH中需包含dockerpm2命令

显著优点

1. 零网络暴露:100%本地运行,消除外部攻击面
2. 纵深防御架构:日志前置、授权开关、白名单限制、次数上限四层防护

3. 运维友好:集成Docker与PM2双生态,覆盖主流容器化与Node.js部署场景

4. 故障可追溯:强制日志检查确保每次恢复决策有据可依

潜在局限

  • 功能边界明确:仅限于监控与重启,无自动扩缩容、配置漂移检测等高级SRE能力
  • 手动配置成本:白名单机制要求运维人员预先维护服务清单,动态环境适应性较弱
  • 单节点视角:缺乏分布式集群层面的协调与状态同步能力

适合人群

  • 金融、医疗等对数据驻留有严格合规要求的本地部署场景
  • 边缘计算节点或隔离网络环境中的运维团队
  • 需要最小权限原则(PoLP)实施的基础设施管理员

常规风险

| 风险类别 | 说明 |
|---------|------|
| 配置误用 | 环境变量设置不当可能导致未授权重启或过度限制 |
| 依赖缺失 | `psutil`未安装或docker/pm2不在PATH会导致功能失效 |
| 白名单滞后 | 服务名称变更未同步更新白名单将阻断合法恢复 |
| 审计盲区 | 内置机制未提及操作审计日志的外部持久化存储 |

Nexus Safe 内容

手动下载zip · 4.4 kB
AGENT_BRAIN.mdtext/markdown
请选择文件