清晰对比 AI 模型
Hungry for Data, Open for All
四类榜单——模型、Agent、LLM 与工具链——在同一视野下横向比较。数据经版本化管线生成,来源与方法论可追溯。
- 搭建本地编码模型:软件栈、权重、显存档
- Qwen3.8-27B:一张 24GB 消费卡,对上 Opus 4.6 的编码表
- DeepSeek V4 Flash 0731 深度评测:1M 上下文 MoE,OpenRouter 仅 $0.09/$0.18
- Claude Opus 5 深度评测:Anthropic 推理与编码旗舰,定价约为 Fable 一半
- Kimi K3 深度测评:2.8T 开源旗舰离 Claude / GPT 还有多远
- 如何选择 AI Infrastructure:模型 API 服务商(Token Provider)实用指南
- Qwen 模型系列深度测评:从 Qwen2.5 到 Qwen3.7 的选型指南
- Grok 4.5 深度评测:xAI 面向编码与 STEM 的旗舰
- Claude Fable 5 深度评测:Anthropic 的 Mythos 级旗舰
- 2026 最强 AI 模型:如何读懂 AI Hippo 排行榜
全局排行榜
查看完整榜单| 排名 | 名称 | Score | 核心指标 | 1M Token (均价) |
|---|---|---|---|---|
| 1 | SpaceXAI: Grok 4.20 Multi-Agent | 99.9 | 2.0M ctx | $1.88 |
| 2 | SpaceXAI: Grok 4.20 | 99.9 | 2.0M ctx | $1.88 |
| 3 | DeepSeek V4 Flash Latest | 90.1 | 1.3M ctx | $0.12 |
| 4 | Meta: Llama 4 Scout | 90.1 | 1.3M ctx | $0.20 |
| 5 | DeepSeek: DeepSeek V4 Flash 0731 | 90.1 | 1.3M ctx | $0.21 |
| 6 | Xiaomi: MiMo-V2.5 | 86.2 | 1.1M ctx | $0.21 |
| 7 | OpenAI: GPT-5.6 Luna Pro (batch) | 86.2 | 1.1M ctx | $0.35 |
| 8 | Google: Lyria 3 Pro Preview | 86.2 | 1.0M ctx | $0.00 |
| 9 | Poolside: Laguna S 2.1 | 86.2 | 1.0M ctx | $0.14 |
| 10 | OpenAI: GPT-5.6 Luna (batch) | 86.2 | 1.1M ctx | $0.35 |
本表主价来源为 OpenRouter 上架价。官方厂商价见 Token 页矩阵。抓取时间:2026-08-18T07:21:10.134Z。
核心目录刷新: