文章
面向决策的深度评测与实用指南,而非单次榜单快照。
-
DeepSeek V4.1 Flash:CED 552B、厂商表上的 agent 分,以及还不存在的 V4.1 Pro
目录 2026-09-10 入库。OpenRouter 主 listing $0.15/$0.60;Fireworks $0.22/$0.66,Together $0.30/$1.20。HF 卡:CED 552B,prefill 8B / decode 16B,全局 KV 890 B/token,MIT。厂商表 Terminal-Bench 2.1 90.6、DeepSWE 74.2(max effort)。本快照无 V4.1 Pro。综合榜 #100(上下文/美元代理,非能力)。0731 仍约便宜 3 倍。
-
Cursor 自带模型探秘:Auto 低保、Composer / Grok,以及何时该掏 Opus 4.6
两口用量池:Cursor Models(Composer / Grok)更宽;Opus 4.6 吃 Other Models。Auto 是路由器不是第四个模型——Auto Cost = 日常低保。同任务 100K+20K:Composer ~$0.10,Grok ~$0.32,Opus ~$1.00。非独立基准测试。
-
Qwen3.8-27B:一张 24GB 消费卡,对上 Opus 4.6 的编码表
Apache-2.0 稠密 27.78B,Q4 约 17GB,能进 24GB 消费卡。OpenRouter 主 listing $0.45/$3.20。Qwen 启动表(厂商自评)SWE-bench Pro 61.7,对 Opus 4.6 Max 导入分 53.4;Terminal-Bench 73.0 对 78.2。同任务 100K+20K:本地约 $0,托管约 $0.11,Opus $1.00。非独立基准测试。
-
搭建本地编码模型:软件栈、权重、显存档
换栈便宜,模型体积锁死硬件,硬件贵且难退。权重能进卡 ≠ 目标上下文能进。对照 API 的 100K+20K 账单再买卡。
-
DeepSeek V4 Flash 0731 深度评测:1M 上下文 MoE,OpenRouter 仅 $0.09/$0.18
284B/13B 稀疏 MoE、100 万 token 上下文、reasoning/tools;OpenRouter 主 listing $0.09/$0.18。HF Hot 增长 +64%,目录首次出现 2026-08-01——本站综合榜 #9(上下文/美元代理指标,非能力分)。
-
Claude Opus 5 深度评测:Anthropic 推理与编码旗舰,定价约为 Fable 一半
1M 上下文、多模态、reasoning/tools;$5/$25(OpenRouter 主 listing + anthropic-direct 已验证)。另有 2× 价的 Fast SKU($10/$50)。目录首次出现:2026-07-26。
-
Kimi K3 深度测评:2.8T 开源旗舰离 Claude / GPT 还有多远
2.8T MoE、1M 上下文、$3/$15(cache $0.30);AA Index 57,紧贴 Fable/Sol,却在长程 agent 编码上抢戏——以及相对 K2.6 该不该升级。数据截止 2026-07-22。
-
如何选择 AI Infrastructure:模型 API 服务商(Token Provider)实用指南
Vendor 造模型,Token Provider 提供推理 API。用本决策框架,结合 AI Hippo 上的多源 USD/1M 实价,在官方直连、聚合器与云平台之间做可复现的选型。
-
Qwen 模型系列深度测评:从 Qwen2.5 到 Qwen3.7 的选型指南
目录中 49 个 Qwen SKU 横跨 Max、Plus、Flash、Coder 与 VL 五条线——旗舰 Qwen3.7 Max 输入/输出 $1.25/$3.75,Flash 仅 $0.065/$0.26,Coder 免费版 unified 榜 #6。
-
Grok 4.5 深度评测:xAI 面向编码与 STEM 的旗舰
500K 上下文、多模态、原生推理与工具调用,输入/输出 $2/$6(OpenRouter 主 listing)——比同门 4.20 更贵、上下文更短,换的是旗舰定位。
-
Claude Fable 5 深度评测:Anthropic 的 Mythos 级旗舰
1M 上下文、多模态、支持推理与工具调用,输入/输出 $10/$50(多源已验证)——它适合谁、何时选它。
-
2026 最强 AI 模型:如何读懂 AI Hippo 排行榜
解读统一模型榜、价格快照的实用指南,以及何时应运行自有基准测试。
-
Claude Mythos 5 是什么:Anthropic 的 Mythos 级家族与爆火的开源派生
“Mythos 5” 不是单一模型,而是 Fable 5 所属的 Mythos 级家族;它在 Hugging Face 上因 Qwythos-9B 等社区派生(下载超 150 万)而爆火。
-
多源 Token 成本对比:如何读 AI Hippo 定价矩阵
OpenRouter 主价、官方直采与云厂商标价如何并列展示,以及何时应上报 price-correction。
简报
定期榜单脉冲、Token 经济周报及其他流水线自动生成的更新。
-
周热度脉冲 2026-W39:laya
近期趋势信号为 —,来源厂商 convaiinnovations。
-
周榜脉冲 2026-W39:综合榜 Top 4
本期快照前列:#1 SpaceXAI: Grok 4.20 Multi-Agent (2.0M ctx); #2 Z.ai: GLM Flash Latest (1.3M ctx); #3 Meta: Llama 4 Scout (1.3M ctx); #4 DeepSeek: DeepSeek V4 Flash Latest (1.3M ctx)。
-
Token 经济周报 2026-W39:多源价格变动
verified 覆盖率 100% · Top50 双源 26%。
-
Thinking Machines: Inkling Small (free):免费档到底能用到什么
Thinking Machines: Inkling Small (free) 在 AI Hippo 榜单排名 #11,1.0M 上下文,本快照含免费档。含规格、成本测算与横向对比。
-
Z.ai: GLM 5.3 Flash:多模态规格、定价与适配
Z.ai: GLM 5.3 Flash 在 AI Hippo 榜单排名 #5,1.3M 上下文,$0.15 input / $0.50 output per 1M tokens。含规格、成本测算与横向对比。
-
Meta: Muse Spark 1.3 Contributor:多模态规格、定价与适配
Meta: Muse Spark 1.3 Contributor 在 AI Hippo 榜单排名 #14,1.0M 上下文,$0.10 input / $0.20 output per 1M tokens。含规格、成本测算与横向对比。
-
Meituan: LongCat 2.0 评测:规格、定价与适用场景
Meituan: LongCat 2.0 在 AI Hippo 榜单排名 #10,1.0M 上下文,$0.30 input / $1.20 output per 1M tokens。含规格、成本测算与横向对比。
-
Google: Lyria 3 Pro Preview:免费档到底能用到什么
Google: Lyria 3 Pro Preview 在 AI Hippo 榜单排名 #12,1.0M 上下文,本快照含免费档。含规格、成本测算与横向对比。
-
Qwen: Qwen3.8 2.4T A95B 评测:规格、定价与适用场景
Qwen: Qwen3.8 2.4T A95B 在 AI Hippo 榜单排名 #18,1.0M 上下文,$2.00 input / $6.00 output per 1M tokens。含规格、成本测算与横向对比。
-
Poolside: Laguna S 2.1 评测:规格、定价与适用场景
Poolside: Laguna S 2.1 在 AI Hippo 榜单排名 #13,1.0M 上下文,$0.09 input / $0.18 output per 1M tokens。含规格、成本测算与横向对比。
-
MiniMax: MiniMax M3:多模态规格、定价与适配
MiniMax: MiniMax M3 在 AI Hippo 榜单排名 #15,1.0M 上下文,$0.30 input / $1.20 output per 1M tokens。含规格、成本测算与横向对比。
-
Meta: Llama 4 Scout:多模态规格、定价与适配
Meta: Llama 4 Scout 在 AI Hippo 榜单排名 #3,1.3M 上下文,$0.10 input / $0.30 output per 1M tokens。含规格、成本测算与横向对比。
-
Tencent: Hy4 preview 评测:规格、定价与适用场景
Tencent: Hy4 preview 在 AI Hippo 榜单排名 #16,1.0M 上下文,$0.83 input / $2.50 output per 1M tokens。含规格、成本测算与横向对比。
-
MoonshotAI: Kimi K3 (batch):多模态规格、定价与适配
MoonshotAI: Kimi K3 (batch) 在 AI Hippo 榜单排名 #20,1.0M 上下文,$2.28 input / $11.40 output per 1M tokens。含规格、成本测算与横向对比。
-
OpenAI: GPT-6 Luna Pro (batch):多模态规格、定价与适配
OpenAI: GPT-6 Luna Pro (batch) 在 AI Hippo 榜单排名 #7,1.1M 上下文,$0.05 input / $0.25 output per 1M tokens。含规格、成本测算与横向对比。
-
Xiaomi: MiMo-V2.5:多模态规格、定价与适配
Xiaomi: MiMo-V2.5 在 AI Hippo 榜单排名 #8,1.1M 上下文,$0.14 input / $0.28 output per 1M tokens。含规格、成本测算与横向对比。
-
SpaceXAI: Grok 4.20 Multi-Agent:超长上下文选手实测
SpaceXAI: Grok 4.20 Multi-Agent 在 AI Hippo 榜单排名 #1,2M 上下文,$1.25 input / $2.50 output per 1M tokens。含规格、成本测算与横向对比。