SpaceXAI: Grok 4.20 Multi-Agent:超长上下文选手实测

SpaceXAI: Grok 4.20 Multi-Agent 在 AI Hippo 榜单排名 #1,2M 上下文,$1.25 input / $2.50 output per 1M tokens。含规格、成本测算与横向对比。

速览要点

SpaceXAI: Grok 4.20 Multi-Agent(x-ai)主打"够长":2M 上下文(#1),瞄准整仓代码与长文档。定价 $1.25 input / $2.50 output per 1M tokens,卖点是一次能喂进多少内容。

规格速览(参数党)

硬指标:2M 上下文;多模态(文本/图像/文件输入);暴露 11 个 API 参数、结构化输出,并支持推理。据此判断是否适配 agent、长上下文或结构化输出场景。

定价与横向对比

定价:$1.25 input / $2.50 output per 1M tokens。其混合价 $1.88 高于 前 20 中位数($0.34)。综合榜偏好便宜的长上下文模型(如 Meta: Llama 4 Scout),排名靠后代表性价比更弱,而非能力更弱。

正面对比

榜单上离它最近的是 Meta: Llama 4 Scout(1.3M 上下文,$0.20/1M blended)。并排看,SpaceXAI: Grok 4.20 Multi-Agent 是 2M 上下文、$1.88/1M blended:上下文更长,混合 token 价更贵。按你的负载受限于哪一维来二选一。

适用场景

最契合的场景:整仓代码与长文档、截图/PDF/图片理解、结构化输出管线、多步推理.

成本实测与结论

一次典型的 10 万输入 + 2 万输出任务在 SpaceXAI: Grok 4.20 Multi-Agent 上约 $0.17。结论:均衡的中档之选——需要能力余量又不想付顶级 token 价时合适。

洞察