核心用法
ClaudeHemat 是一套模型分层调度策略,将用户请求按复杂度自动路由至三个层级的 Claude 模型:
| 层级 | 模型 | 适用场景 | 禁止行为 |
|:---|:---|:---|:---|
| L1 快速响应 | **Haiku 4.5** (默认) | 简单问答、闲聊、文件查找、Cron 任务 | 编码、分析、任何推理 |
| L2 专业处理 | **Sonnet 4.5** | 代码编写、分析对比、规划报告、一般推理 | 关键决策自动升级 |
| L3 深度引擎 | **Opus 4.6** | 深度研究、关键决策、极端复杂推理与规划 | 无 |
通过 sessions_spawn 显式触发高级模型,任务完成后自动回退至 Haiku 4.5。每条输出必须标注当前使用模型。
显著优点
1. 成本效率最大化:避免对简单查询使用昂贵的大模型,显著降低 Token 消耗
2. 响应速度分级:常规交互毫秒级响应,复杂任务再触发深度思考
3. 确定性路由规则:11 条明确的升级/降级条件,消除模型选择的模糊性
4. 透明可审计:强制模型标注机制,用户始终知晓当前调用层级
潜在局限
- 边界判断成本:用户需自行评估请求复杂度,误判可能导致过度升级或能力不足
- 上下文切换开销:频繁 spawn 新会话可能丢失部分上下文连续性
- 生态锁定:紧密绑定 Claude 系列模型,迁移至其他厂商需重构策略
- "关键决策"定义模糊:Sonnet 升级条件依赖主观判断,存在执行差异
适合人群
- 高频使用 Claude API 的开发者与团队
- 需严格控制 LLM 成本的企业级应用架构师
- 对响应延迟敏感、希望分层优化用户体验的产品
常规风险
| 风险类型 | 说明 | 缓解建议 |
|:---|:---|:---|
| 降级执行失效 | 高级模型任务完成后未回退至 Haiku | 建立会话状态检查机制 |
| 过度升级陷阱 | 保守策略导致 Opus 滥用,成本失控 | 定期审计模型调用日志 |
| 标注遗漏 | 输出未包含模型标识,调试困难 | 集成 linter 强制检查 |
| 权限滥用 | `sessions_spawn` 被非授权调用 | 实施调用频次与权限管控 |