Claude Opus 5 深度评测:Anthropic 推理与编码旗舰,定价约为 Fable 一半

1M 上下文、多模态、reasoning/tools;$5/$25(OpenRouter 主 listing + anthropic-direct 已验证)。另有 2× 价的 Fast SKU($10/$50)。目录首次出现:2026-07-26。

它是什么

Claude Opus 5 是 Anthropic 在 AI Hippo 目录中标注的旗舰 SKU,面向高要求推理、编码与长程 agent 工作。目录描述强调端到端软件任务、代码审查与找 bug、以及视觉分析。规格上:100 万 token 上下文;输入文本/图像/文件,输出文本;暴露 reasoning、reasoning_effort、tools、structured_outputs 等 agent 友好参数。

站内 `ops_model_first_seen` 记录其与 `claude-opus-5-fast` 于 2026-07-26 首次入库——比 Sonnet 5(更早)和已有 Fable 5 文更新。选型时先分清三条 Anthropic 线:Sonnet(吞吐/成本)、Opus(旗舰平衡)、Fable / Mythos 级(最高单价档)。

规格速览(参数党)

硬指标(`core_model`):上下文 1,000,000;模态 `text+image+file->text`。常规 Opus 5 暴露 12 个 API 参数:include_reasoning、max_completion_tokens、max_tokens、reasoning、reasoning_effort、response_format、stop、structured_outputs、temperature、tool_choice、tools、verbosity。

同门 Fast 变体(`anthropic/claude-opus-5-fast`)同为 1M 上下文与相同模态,但参数列表略窄(无 temperature、无 max_completion_tokens);目录写明能力相同、输出更快、定价为常规 Opus 的 2 倍。本快照未披露知识截止日期;已验证 host 上未见独立的 batch / cached-input 档位(anthropic-direct 的 cached 字段为 0)。厂商:Anthropic。

价格与在哪调用

常规 Opus 5:每百万 token 输入 $5、输出 $25。本快照在 OpenRouter 主 listing(is_primary_listing=1)与 anthropic-direct(model_bound_verified)交叉一致。输出价是输入价的 5 倍——长生成与 agent 循环会明显抬高账单。

Opus 5 Fast:OpenRouter 主 listing 为 $10/$50,恰为常规的 2×,与 Fable 5 标价同档。选型时把 Fast 当成「同能力、换吞吐」的溢价档,而不是另一个模型家族。

本快照未在 Bedrock / DeepInfra 等路径验证到 Opus 5 行(Sonnet 5 / Fable 5 则有多 host)。上线前在 Token 页再扫一遍 host 覆盖。

家族阶梯:Sonnet 5 → Opus 5 → Fable 5(测评)

同快照 Anthropic 阶梯(OpenRouter 主 listing,1M 上下文对齐):Sonnet 5 为 $2/$10(混合约 $6),Opus 5 为 $5/$25(混合约 $15),Fable 5 与 Opus 5 Fast 均为 $10/$50(混合约 $30)。相对 Sonnet,Opus 输入约 2.5×、输出 2.5×;相对 Opus,Fable/Fast 再 2×。

规格上三者均 1M、多模态与 reasoning/tools;Opus 常规额外暴露 temperature。综合榜(上下文/美元代理指标,非能力 benchmark)上:Sonnet 5 约 #21;Opus 5 与 Fable 5 尚未进入本快照 unified Top——高单价会压低该代理分。

选型口诀:默认吞吐与预算 → Sonnet 5;要目录标注的旗舰推理/编码档且愿付约 2.5× Sonnet → Opus 5;要最高标价档或「同价买吞吐」→ Fable 5 / Opus Fast。

跨厂价格与规格对比(测评)

混合价(OpenRouter 主 listing 均值):Opus 5 约 $15/1M;对照 GPT-5.6 Sol 约 $17.50(1.05M)、GPT-5.4 约 $8.75(1.05M)、Kimi K3 约 $9(1.0M)、Gemini 3.1 Pro Preview 约 $7(1.0M)、Grok 4.5 约 $4(0.5M)、Llama 4 Scout 约 $0.20(1.3M)。

Opus 落在「贵于主流多模态、仍明显低于 Fable/Sol 顶档」的区间。它未进本快照综合榜 Top——再次强调:该分数奖励便宜长上下文,不是 arena/能力分。评判 Opus 应看旗舰定位与 agent/编码契合度,而不是代理名次。以上为规格与成本对比,非能力基准测试。

成本实测:两个场景(测评)

按本快照 OpenRouter 主 listing 推算(不含额外 reasoning token)。

场景 A — agent 编码一轮(10 万输入 + 2 万输出):Opus 5 约 $1.00($0.50+$0.50);Sonnet 5 约 $0.40;Kimi K3 约 $0.60;GPT-5.4 约 $0.55;GPT-5.6 Sol 约 $1.10;Fable 5 / Opus Fast 约 $2.00;Grok 4.5 约 $0.32。

场景 B — 长文档一轮(50 万输入 + 5 千输出):Opus 5 约 $2.62;Sonnet 约 $1.05;K3 约 $1.57;Sol 约 $2.65;Fable/Fast 约 $5.25;GPT-5.4 约 $1.32。

结论:Opus 落在 Sol 附近、约为 Fable 一半、约为 Sonnet 2.5×。输出重的循环里,Opus→Fast/Fable 的再 2× 跳升最刺痛。以上为规格与成本对比,非能力基准测试。

何时选它、何时别选

选 Opus 5:需要 Anthropic 目录旗舰档的推理/编码/长程 agent,1M 上下文与多模态够用,且愿付约 Sonnet 2.5×、仍显著低于 Fable 的账单;默认用常规 SKU,只在延迟瓶颈时再试 Fast。

别选 / 看别的:高并发短任务、成本敏感 → Sonnet 5 或更便宜的 Grok/K3;必须顶价档 Mythos 叙事或已验证「答案质量压过 2× 溢价」→ Fable 5;多云路径尚未覆盖 Opus 时,先确认 Token 页 host,或暂时用已有多 host 的 Sonnet/Fable。

用 AI Hippo 模型页、Token 页与对比页做定量取舍;综合榜是上下文/美元代理指标,不是能力 benchmark。

落地检查清单

集成前:在路由层显式区分 `claude-opus-5` 与 `claude-opus-5-fast`,避免把 2× 价当成默认;确认 harness 支持 reasoning / reasoning_effort / tools / structured_outputs;按真实输入输出比做预算,而不是只看 $5 输入价。

运维侧:对 agent 环监控每轮 token(含 reasoning);延迟 SLA 不达标再灰度 Fast;定期对照 Token 页是否新增 Bedrock 等 host。数据口径以本站 SQLite 快照为准,上线前再跑一次 `data:update` 核对单价。

来源

证据与行动建议

  • 时间窗口: catalog snapshot (first_seen 2026-07-26)
  • 观测数量: 4
  • 来源类型: catalog_and_pricing
  • 在 /zh/model/anthropic-claude-opus-5/ 查看 Opus 5 完整规格与定价
  • 在 /zh/model/anthropic-claude-opus-5-fast/ 对照 Fast 变体(2× 价)
  • 在 /zh/model/anthropic-claude-sonnet-5/ 对比同门 Sonnet 5
  • 用 /zh/token/ 核对多 host 报价
  • 在 /zh/compare/ 与 Fable 5 / Sol 并排比较

洞察