Claude Hemat

🩸 智能分层调度,精准匹配算力需求

智能模型调度框架,自动分级调用 Claude Haiku/Sonnet/Opus,实现性能与成本的精准平衡。

收藏
5.3k
安装
1.1k
版本
1.0.2
CLS 安全扫描中
预计需要 3 分钟...

使用说明

核心用法

ClaudeHemat 是一套模型分层调度策略,将用户请求按复杂度自动路由至三个层级的 Claude 模型:

| 层级 | 模型 | 适用场景 | 禁止行为 |
|:---|:---|:---|:---|
| L1 快速响应 | **Haiku 4.5** (默认) | 简单问答、闲聊、文件查找、Cron 任务 | 编码、分析、任何推理 |
| L2 专业处理 | **Sonnet 4.5** | 代码编写、分析对比、规划报告、一般推理 | 关键决策自动升级 |
| L3 深度引擎 | **Opus 4.6** | 深度研究、关键决策、极端复杂推理与规划 | 无 |

通过 sessions_spawn 显式触发高级模型,任务完成后自动回退至 Haiku 4.5。每条输出必须标注当前使用模型。

显著优点

1. 成本效率最大化:避免对简单查询使用昂贵的大模型,显著降低 Token 消耗
2. 响应速度分级:常规交互毫秒级响应,复杂任务再触发深度思考

3. 确定性路由规则:11 条明确的升级/降级条件,消除模型选择的模糊性

4. 透明可审计:强制模型标注机制,用户始终知晓当前调用层级

潜在局限

  • 边界判断成本:用户需自行评估请求复杂度,误判可能导致过度升级或能力不足
  • 上下文切换开销:频繁 spawn 新会话可能丢失部分上下文连续性
  • 生态锁定:紧密绑定 Claude 系列模型,迁移至其他厂商需重构策略
  • "关键决策"定义模糊:Sonnet 升级条件依赖主观判断,存在执行差异

适合人群

  • 高频使用 Claude API 的开发者与团队
  • 需严格控制 LLM 成本的企业级应用架构师
  • 对响应延迟敏感、希望分层优化用户体验的产品

常规风险

| 风险类型 | 说明 | 缓解建议 |
|:---|:---|:---|
| 降级执行失效 | 高级模型任务完成后未回退至 Haiku | 建立会话状态检查机制 |
| 过度升级陷阱 | 保守策略导致 Opus 滥用,成本失控 | 定期审计模型调用日志 |
| 标注遗漏 | 输出未包含模型标识,调试困难 | 集成 linter 强制检查 |
| 权限滥用 | `sessions_spawn` 被非授权调用 | 实施调用频次与权限管控 |

Claude Hemat 内容

手动下载zip · 1.2 kB
SKILL.mdtext/markdown
请选择文件