LLM Supervisor

🔮 智能限流降级 · 本地云端无缝切换

智能处理 LLM 速率限制,提供 Ollama 本地模型无缝切换,确保代码生成任务安全可控

收藏
7.5k
安装
3k
版本
0.3.0
CLS 安全性认证2026-06-04
点击查看完整报告 >

使用说明

核心用法

LLM Supervisor 是一个专门处理大语言模型服务异常的智能中间层,主要解决云服务商(Anthropic、OpenAI)速率限制和过载错误导致的体验中断问题。

触发机制:当检测到 API 返回 429(Rate Limit)或 503(Overload)错误时,系统立即向用户透明报告,而非静默重试或失败。随后主动提供本地 Ollama 模型作为备选方案,支持 qwen2.5:7b 等开源模型无缝接管任务。

分层确认策略

  • 代码生成任务:强制人工确认("Cloud is rate-limited. Switch to local Ollama? Reply 'yes' to confirm"),防止本地模型代码质量风险
  • 简单对话/摘要:若用户历史已授权,可自动降级切换

状态管理:会话级内存跟踪当前 provider、最近限流时间戳、代码任务授权状态;每次新会话重置为云端优先。

显著优点

1. 零中断体验:将硬错误转化为可选降级路径,避免工作流卡死
2. 安全边界清晰:代码任务强制确认体现对本地模型能力边界的清醒认知

3. 透明可控/llm status 实时展示系统状态,用户始终掌握决策权

4. 隐私友好:本地运行敏感任务时无需数据出境

潜在缺点与局限性

  • 模型能力落差qwen2.5:7b 与 Claude/GPT-4 存在显著质量差距,复杂推理、长上下文、代码生成任务可能输出不稳定
  • 本地资源依赖:需预装 Ollama 并拉取模型,对设备内存(建议 8GB+)和 GPU 有要求
  • 状态非持久化:会话结束即重置,跨会话无法记住用户偏好
  • 单点模型配置:仅硬编码 qwen2.5:7b,缺乏灵活模型选择机制

适合人群

  • 高频调用 API 的开发者(易触限流阈值)
  • 网络不稳定或需离线工作的用户
  • 处理敏感代码/数据、偏好本地执行的安全导向用户
  • 已部署 Ollama 环境的 macOS/Linux 开发者

常规风险

1. 代码质量风险:7B 参数模型生成代码未经充分验证直接采用,可能引入隐蔽 bug 或安全漏洞
2. 幻觉放大:本地模型事实准确性弱于云端,摘要类任务可能出现虚构信息

3. 配置漂移:用户环境 Ollama 版本/模型差异导致行为不一致

4. 确认疲劳:频繁限流下反复确认可能降低用户警惕性,习惯性点击 "yes"

安全解读

核心功能

LLM Supervisor 是一款面向开发者的智能流量管理 Skill,专为解决云端大模型 API 的限流(rate limit)过载(overload)问题而设计。其核心机制是在检测到 Anthropic、OpenAI 等云服务商返回限流错误时,第一时间通知用户(而非静默重试),并主动提供本地 Ollama 回退方案,实现云端与本地 LLM 的无缝切换。

显著优点

1. 用户主权优先:区别于自动降级策略,该 Skill 坚持"告知-确认-执行"原则,尤其在代码生成任务中强制要求显式确认Reply 'yes' to confirm),避免意外使用本地模型导致代码质量下降
2. 状态透明可控:通过 /llm status/llm switch local/cloud 等命令,用户可实时掌握当前提供商、Ollama 可用性及历史限流事件

3. 安全架构顶级:S+ 评级,94 分,零第三方依赖,仅使用 OpenClaw SDK 安全 API,无硬编码密钥、无文件系统越权、无数据外泄风险

4. 网络隔离严格:仅连接本地回环地址 127.0.0.1:11434,符合企业内网安全要求

潜在局限

  • 功能单一聚焦:仅处理限流/回退场景,不提供负载均衡、成本优化等高级流量管理功能
  • 本地模型依赖:需用户预装 Ollama 及指定模型(默认 qwen2.5:7b),初次配置存在门槛
  • 确认流程或显繁琐:高频限流场景下,代码任务的强制确认可能中断工作流

适合人群

  • 频繁遭遇 API 限流的开发者(尤其是使用 Claude/ChatGPT 编程场景)
  • 注重数据隐私、偏好本地 LLM 的敏感代码工作者
  • 企业内网环境,需严格限制外发流量的合规场景

常规风险

| 风险类型 | 等级 | 说明 |
|---------|------|------|
| 数据泄露 | 极低 | 仅本地通信,无云端数据传输 |
| 供应链攻击 | 极低 | 零第三方 npm 依赖 |
| 误操作风险 | 低 | 代码任务强制确认机制有效 mitigation |
| 可用性风险 | 中 | 本地 Ollama 未启动时回退失效 |

LLM Supervisor 内容

commands文件夹
dist文件夹
commands文件夹
hooks文件夹
hooks文件夹
types文件夹
@openclaw文件夹
手动下载zip · 10.7 kB
llm.tstext/plain
请选择文件