Which LLM? Deterministic model selection for agents

🎯 智能选型·链上支付·结果返利

为AI Agent提供确定性LLM选型决策服务,支持USDC支付与结果反馈赚积分,需独立低余额钱包与多源地址验证

收藏
7k
安装
2.5k
版本
1.0.15
CLS 安全性认证2026-07-14
点击查看完整报告 >

使用说明

核心用法

Which‑LLM 是一个面向AI Agent的决策优化API服务,核心功能是在成本与质量约束下推荐最优LLM选型,而非直接调用模型。典型使用流程:

1. 前置配置:创建独立EVM钱包(非主钱包),预存$2-10 USDC及少量gas代币,优先使用加密keystore(WALLET_KEYSTORE_PATH + 密码)而非明文私钥
2. 多源验证:首次使用前必须通过至少两个渠道验证收款地址一致性,包括API端点/.well-known/payment-address.txt、ENS域名which-llm.eth等,发现不一致立即停用并举报

3. 付费调用:向POST /decision/optimize提交目标描述与约束条件(如max_cost_usd: 0.01min_quality_score: 0.8),若返回HTTP 402则按指引完成USDC支付(支持Base、Arbitrum等L2),携带支付凭证重试

4. 结果反馈:执行推荐模型后,调用POST /decision/outcome报告实际成本、延迟、质量评分,换取credit_token抵扣后续请求费用

显著优点

  • 经济透明:按次USDC付费,无订阅门槛;结果反馈机制形成"支付-优化-返利"闭环
  • 决策可审计:确定性输出(非概率性),便于合规场景追溯选型逻辑
  • 链上兼容:原生支持多链USDC,Gas成本低
  • 安全设计:强制隔离钱包、多源地址验证、支付需人工审批(默认模式)

潜在局限与风险

| 维度 | 说明 |
|------|------|
| **信任假设** | 多源验证路径可能共享同一运营方控制,缺乏独立签名校验或链上证明作为终极信任锚 |
| **支付摩擦** | HTTP 402流程需Agent具备钱包签名能力,非托管场景下实现"人工审批"依赖Host合规实现,存在配置绕过风险 |
| **范围边界** | 仅做选型推荐,不直接执行模型调用,需额外集成目标LLM客户端 |
| **资金暴露** | 虽建议低余额,但keystore或私钥若泄露仍可能导致资金损失 |

适合人群

  • 需要自动化模型选型的AI Agent开发者(如多模型路由、成本敏感型应用)
  • 追求链上透明计费的DeFi/Web3原生项目
  • 合规审计需求的企业级LLM调用场景

常规风险

1. 地址劫持:若仅验证单一渠道即付款,可能遭遇DNS/前端攻击导致资金被骗
2. 配置降级:Host可能未严格执行"默认人工审批",开启免审批模式后小额高频支付累积风险

3. 合约漏洞:USDC转账虽标准,但收款合约若被控制存在冻结或资金截留可能(文档未披露合约审计信息)

4. 反馈博弈:恶意报告虚假outcome可能污染系统模型,但文档未详述反作弊机制

安全解读

核心功能

Decision Economic Optimizer 是一个面向AI Agent的确定性决策排名API,核心能力是在显式成本与质量约束下,为Agent推荐最优LLM模型及备选方案。Skill本身不执行模型推理,而是作为智能调度层,帮助Agent决策"下一步调用哪个模型"。

显著优势

1. 经济透明:采用HTTP 402支付模型,每次调用明码标价(约$0.01级别),支持Base、Ethereum、Arbitrum、Optimism、Avalanche等多链USDC支付
2. 结果反馈闭环:通过POST /decision/outcome上报真实执行结果(实际成本、延迟、质量评分),赚取积分代币降低后续调用成本

3. 安全架构设计完善:强制要求独立低余额钱包(建议$2-10 USDC)、提供多通道支付地址验证机制(.well-known端点 + ENS)、优先支持加密密钥库而非裸私钥

4. 合规性优秀:通过GDPR/CCPA合规审计,仅收集必要钱包凭证,不采集系统信息或敏感数据

5. 轻量无依赖:纯声明型配置,0第三方依赖,无可执行代码,静态安全评分98分

潜在局限与风险

1. T3来源可信度:维护者为个人开发者zapkid,非企业级背书,虽代码安全但存在运营持续性风险
2. 支付地址验证负担:用户需主动跨至少两个渠道验证收款地址,增加首次使用摩擦

3. 402支付流程复杂度:相比传统API Key模式,USDC链上支付需要钱包管理、gas费预估、交易确认等额外认知负担

4. 网络依赖单一:所有端点集中于api.which-llm.com单一域名,无备用域名或IP分散

5. 无密码学强信任锚:当前未提供独立签名声明、链上地址认证等加密学信任根

适合人群

  • 成本敏感型AI Agent开发者:需要在GPT-4级别质量与GPT-4o-mini成本之间做精确权衡
  • 多模型Fallback策略实施者:要求确定性、可审计的模型降级决策链路
  • Web3原生Agent团队:已具备EVM钱包管理经验,接受USDC支付模式
  • 合规要求严格的B2B场景:需GDPR/CCPA就绪的第三方决策服务

常规风险

| 风险类型 | 等级 | 说明 |
|---------|------|------|
| 钱包资金安全 | 中 | 虽设计强制低余额隔离钱包,但若用户误用主钱包或私钥泄露仍存在损失可能 |
| 支付地址篡改 | 中 | 依赖TLS和多通道验证,无独立签名信任锚,理论上存在DNS/证书攻击窗口 |
| API服务持续性 | 中高 | 个人项目,无SLA承诺,存在停止服务风险 |
| 链上交易失败 | 低 | gas价格波动、网络拥堵可能导致支付确认延迟 |

使用建议

严格遵循文档安全实践:创建专用钱包、验证支付地址、优先使用加密密钥库、启用每次请求人工确认。初始测试资金建议控制在$1-2 USDC + $1-2 gas token。

Which LLM? Deterministic model selection for agents 内容

手动下载zip · 8.3 kB
skill.jsonapplication/json
请选择文件