自动追踪每日更新的AI SOTA模型数据库,聚合LMArena、Artificial Analysis等权威来源,支持JSON/CSV/REST API/MCP多种接入方式
说明:
## 核心功能
SOTA Tracker 是一个开源的AI模型追踪数据库,自动每日更新来自 LMArena(600万+人工投票Elo排名)、Artificial Analysis(LLM基准测试与定价)、HuggingFace(模型下载趋势)等权威来源的数据。涵盖LLM API/本地部署、图像生成、视频生成、语音合成/识别、向量嵌入等9大类别。
## 显著优点
1. **多维度数据整合**:不仅提供排名,还包含价格、速度、质量评分、硬件要求等决策关键信息
2. **灵活的接入方式**:支持静态文件下载(JSON/CSV/SQLite)、REST API、MCP服务器,以及专为Claude Code优化的嵌入式静态摘要
3. **自动化运维**:GitHub Actions每日自动爬取更新,systemd定时任务支持本地自动化
4. **实用衍生功能**:内置”forbidden”过时模型清单、模型新鲜度检查、任务推荐引擎
5. **成本优化设计**:针对Claude Code用户明确推荐静态文件嵌入(低token消耗),而非MCP方式
## 潜在局限
– **数据来源依赖**:核心排名完全依赖第三方平台(LMArena/AA),若其API变更或限流会影响服务
– **更新延迟**:每日更新频率对快节奏的AI领域可能仍有滞后(如模型发布当天无法立即获取)
– **手动维护类别**:视频/图像/音频模型依赖人工策划,覆盖完整性不如LLM自动爬取
– **地域可用性**:未标注模型在各地区的API可用性(如部分模型在中国无法访问)
– **MCP非默认**:MCP服务器虽提供但需手动启用,且文档明确提示token成本较高
## 适合人群
– AI应用开发者需要选型参考
– 技术团队构建内部模型评估流程
– Claude Code/OpenCode用户希望系统知晓最新SOTA
– 研究者追踪模型演进趋势
## 常规风险
– **数据准确性风险**:爬取数据可能存在瞬时错误,关键决策建议交叉验证原始来源
– **许可合规**:虽标注robots.txt许可,但大规模商业使用需关注各数据源的TOU变更
– **模型过时风险**:”forbidden”清单依赖维护者判断,可能遗漏或误判
– **依赖安全性**:使用Playwright爬取,需确保Chromium组件来源可信








