清晰对比 AI 模型
Hungry for Data, Open for All
四类榜单——模型、Agent、LLM 与工具链——在同一视野下横向比较。数据经版本化管线生成,来源与方法论可追溯。
- DeepSeek V4.1 Flash:CED 552B、厂商表上的 agent 分,以及还不存在的 V4.1 Pro
- Cursor 自带模型探秘:Auto 低保、Composer / Grok,以及何时该掏 Opus 4.6
- Qwen3.8-27B:一张 24GB 消费卡,对上 Opus 4.6 的编码表
- 搭建本地编码模型:软件栈、权重、显存档
- DeepSeek V4 Flash 0731 深度评测:1M 上下文 MoE,OpenRouter 仅 $0.09/$0.18
- Claude Opus 5 深度评测:Anthropic 推理与编码旗舰,定价约为 Fable 一半
- Kimi K3 深度测评:2.8T 开源旗舰离 Claude / GPT 还有多远
- 如何选择 AI Infrastructure:模型 API 服务商(Token Provider)实用指南
- Qwen 模型系列深度测评:从 Qwen2.5 到 Qwen3.7 的选型指南
- Grok 4.5 深度评测:xAI 面向编码与 STEM 的旗舰
全局排行榜
查看完整榜单| 排名 | 名称 | Score | 核心指标 | 1M Token (均价) |
|---|---|---|---|---|
| 1 | SpaceXAI: Grok 4.20 Multi-Agent | 99.9 | 2.0M ctx | $1.88 |
| 2 | SpaceXAI: Grok 4.20 | 99.9 | 2.0M ctx | $1.88 |
| 3 | Meta: Llama 4 Scout | 90.4 | 1.3M ctx | $0.20 |
| 4 | OpenAI: GPT-6 Luna Pro (batch) | 86.5 | 1.1M ctx | $0.15 |
| 5 | Thinking Machines: Inkling Small (free) | 86.5 | 1.0M ctx | $0.00 |
| 6 | Google: Lyria 3 Pro Preview | 86.5 | 1.0M ctx | $0.00 |
| 7 | Z.ai: GLM 5.3 Flash (batch) | 86.5 | 1.0M ctx | $0.13 |
| 8 | Poolside: Laguna S 2.1 | 86.5 | 1.0M ctx | $0.14 |
| 9 | Meta: Muse Spark 1.3 Contributor | 86.5 | 1.0M ctx | $0.15 |
| 10 | OpenAI: GPT-6 Luna (batch) | 86.5 | 1.1M ctx | $0.15 |
本表主价来源为 OpenRouter 上架价。官方厂商价见 Token 页矩阵。抓取时间:2026-10-08T12:23:04.034Z。
核心目录刷新: