核心功能
SOTA Tracker 是一个开源的AI模型追踪数据库,自动每日更新来自 LMArena(600万+人工投票Elo排名)、Artificial Analysis(LLM基准测试与定价)、HuggingFace(模型下载趋势)等权威来源的数据。涵盖LLM API/本地部署、图像生成、视频生成、语音合成/识别、向量嵌入等9大类别。
显著优点
1. 多维度数据整合:不仅提供排名,还包含价格、速度、质量评分、硬件要求等决策关键信息
2. 灵活的接入方式:支持静态文件下载(JSON/CSV/SQLite)、REST API、MCP服务器,以及专为Claude Code优化的嵌入式静态摘要
3. 自动化运维:GitHub Actions每日自动爬取更新,systemd定时任务支持本地自动化
4. 实用衍生功能:内置"forbidden"过时模型清单、模型新鲜度检查、任务推荐引擎
5. 成本优化设计:针对Claude Code用户明确推荐静态文件嵌入(低token消耗),而非MCP方式
潜在局限
- 数据来源依赖:核心排名完全依赖第三方平台(LMArena/AA),若其API变更或限流会影响服务
- 更新延迟:每日更新频率对快节奏的AI领域可能仍有滞后(如模型发布当天无法立即获取)
- 手动维护类别:视频/图像/音频模型依赖人工策划,覆盖完整性不如LLM自动爬取
- 地域可用性:未标注模型在各地区的API可用性(如部分模型在中国无法访问)
- MCP非默认:MCP服务器虽提供但需手动启用,且文档明确提示token成本较高
适合人群
- AI应用开发者需要选型参考
- 技术团队构建内部模型评估流程
- Claude Code/OpenCode用户希望系统知晓最新SOTA
- 研究者追踪模型演进趋势
常规风险
- 数据准确性风险:爬取数据可能存在瞬时错误,关键决策建议交叉验证原始来源
- 许可合规:虽标注robots.txt许可,但大规模商业使用需关注各数据源的TOU变更
- 模型过时风险:"forbidden"清单依赖维护者判断,可能遗漏或误判
- 依赖安全性:使用Playwright爬取,需确保Chromium组件来源可信