2026-05-26 · 更新于 2026-07-21 · 家族选购指南

Claude 家族怎么选?Fable 5 / Opus 4.8 / Sonnet 5 / Haiku 4.5 实测对比

Anthropic 当前在售的 Claude 有四个主力型号:Fable 5(全球 AA 第一)、Opus 4.8(老旗舰降价了)、Sonnet 5(性价比最高)、Haiku 4.5(便宜够用)。 价格从 $5/M 到 $50/M 差 10 倍。该买哪个?直接看数据。

一句话结论

大多数人应该用 Sonnet 5。 AA Intelligence 53、速度 83 t/s、输出价 $10/M——比老旗舰 Opus 4.7 便宜 60%,比 Fable 5 便宜 80%。写代码、做 Agent、日常对话都够用。OpenRouter 上周跑了 0.94T token,和 Opus 4.6 用量持平。

Fable 5 是目前全球最强模型。 AA Intelligence 60 排全球第一(超过 GPT-5.6 Sol 的 59),Arena Text 1507 也是第一。但 $10/$50 的定价也是顶配。只有「必须用最强」的场景才值得花这个钱——比如顶级研究报告、复杂代码审查、高难度 Agent 编排。

Opus 4.8 是「降价老旗舰」。 AA Intelligence 56,比 Fable 5 低 4 分,但价格只有 Fable 5 的一半($5/$25)。Arena Text 1476 比 Opus 4.7 的 1494 还低——有意思的是用户更喜欢 4.7 的输出风格。如果不需要极致智能,Opus 4.8 的 $5/$25 是旗舰档里最便宜的。

Haiku 4.5 适合跑量。 $1/$5、AA Intelligence 30、速度 105 t/s。做分类、摘要、短问答很合适。200K 上下文在 2026 年算短的——长文档别用它。

主力型号参数对照

型号 AA Intel 速度 t/s 上下文 输出价 /M Arena Text
Fable 5
全球 #1
60 62 1M $50 1507
Opus 4.8
当前旗舰
56 60 1M $25 1476
Sonnet 5
性价比王
53 83 1M $10 1461
Haiku 4.5
轻量跑量
30 105 200K $5
Opus 4.7
上一代旗舰
50 1M $25 1494
Sonnet 4.6
上一代主力
34 (Low Effort) 43 1M $15 1471

数据来源:Artificial Analysis(2026-07-21)、Arena Text Elo。灰色行是上一代型号,仍在售但已被新型号全面超越。Opus 4.7 的 Arena Text 1494 高于 Opus 4.8 的 1476——用户在投票中偏好 4.7 的输出风格。

Fable 5:全球最强,但 90% 的人不需要

Claude Fable 5 的 AA Intelligence 60 是全球第一——超过 GPT-5.6 Sol 的 59、Kimi K3 的 57、Opus 4.8 的 56。Arena Text 1507 也是全球第一,Code Arena 1631 同样第一。Vision 1318 第一,Document 1507 并列第一。

简单说:Fable 5 在几乎所有主流维度上都是当前最强。

但价格也顶配:$10 输入 / $50 输出每百万 token。写 4000 字(约 3000 token 输出)花 $0.15,跑 1000 次就是 $150。对比 Sonnet 5 的 $2/$10,Fable 5 输出价贵 5 倍。

值得上 Fable 5 的场景:

  • 高难度代码审查——跨 5+ 文件的大型 refactor、安全漏洞分析
  • 复杂 Agent 编排——调用 5+ 个工具、有状态流转、需要长链路推理
  • 研究报告 / 法律分析——需要极强准确性的长文档结构化分析
  • 「跑一次值回票价」的高难任务——不是日常跑量

不值得上 Fable 5 的场景:

  • 日常对话、客服问答——Sonnet 5 完全够用,便宜 5 倍
  • 批量分类/标注/摘要——Haiku 4.5 或 Sonnet 5 效果差不到 10%、价格便宜 5-10 倍
  • 普通写代码——Sonnet 5 的 Code Arena 1542 已经很强,Fable 5 的 1631 主要赢在极端复杂任务

一个有意思的细节: Fable 5 在 AA 的名字是「Claude Fable 5 (with fallback)」——「with fallback」意味着它可能内置了降级机制(遇到错误自动回退到安全输出),这可能是它 AA 分数特别高的原因之一。如果你需要的是「更聪明但可能犯错」vs「更保守但更准确」,Fable 5 显然是后者。

Opus 4.8:降价老旗舰,$25/M 的旗舰档门票

Opus 4.8 的 AA Intelligence 56,全球第四。比 Fable 5 低 4 分,但价格只有 Fable 5 的一半($5/$25 vs $10/$50)。

但有个反直觉的现象:Opus 4.8 的 Arena Text 分数(1476)比上一代 Opus 4.7(1494)还低 18 分。同样地,Opus 4.8 thinking 的 Document 分数(1475)低于 Opus 4.6 thinking(1508)。

这说明什么?用户更喜欢旧版的输出风格。可能是 4.8 的 RLHF 调优方向变了,也可能是 Fable 5 的「fallback 机制」在底层影响了输出。如果你对输出风格有偏好,建议先试 Opus 4.7(同价 $5/$25),再决定要不要升级到 4.8。

Opus 4.8 的甜蜜点:

  • 需要旗舰级能力但预算有限——$25/M 是旗舰档最低价(对比 GPT-5.6 Sol 的 $30/M)
  • 代码生成——Opus 4.8 Code 1534、Code thinking 1562,仍然是 Claude 家族代码能力前三
  • 长文档分析——1M 上下文全吃下,法律合同、医学文献、审计报告

别买 Opus 4.8 的场景:

  • 日常开发——Sonnet 5 便宜 60%($10 vs $25),代码能力差距不大
  • 追求最快响应——Opus 4.8 速度只有 57 t/s,Sonnet 5 是 83 t/s
  • 追求最强——Fable 5 全面碾压,且同价($50/M 输出)

Sonnet 5:性价比王,开发者的默认选择

Sonnet 5 的 AA Intelligence 53、速度 83 t/s、输出价 $10/M——这三个数字放在一起,是 Claude 家族里性价比最高的组合。

对比几个参照物:

  • 比 Opus 4.8 便宜 60%($10 vs $25),Intelligence 只低 3 分(53 vs 56)
  • 比 Opus 4.7 便宜 60%($10 vs $25),Intelligence 反而更高(53 vs 54,几乎一样)
  • 比 Sonnet 4.6 便宜 33%($10 vs $15),Intelligence 高 19 分(53 vs 34)
  • 比 Fable 5 便宜 80%($10 vs $50),Intelligence 低 7 分(53 vs 60)

OpenRouter 上周用量 0.94T token,和 Opus 4.6(0.94T)持平。开发者用脚投票:Sonnet 5 已经是新的主力。

速度 83 t/s 在 Claude 家族里仅次于 Haiku 4.5(95 t/s),是 Opus 4.8(57 t/s)的 1.6 倍。日常开发体感明显更快。

Sonnet 5 适合的场景:

  • 日常写代码 / Code Review——性价比最优,Code Arena 1542
  • Agent 工具调用——2-5 步工具编排足够稳,不用花 Opus 的钱
  • 文档分析 / 摘要——1M 上下文,$10/M 跑得起量
  • 客服 / 对话——比 Haiku 聪明很多,价格只贵一倍

Sonnet 5 不够的场景:

  • 极复杂推理(10+ 步规划)——偶尔会「忘记」早期约束,这种场景上 Opus
  • 必须最强——研究级分析、高难度安全审计,Fable 5 更靠谱
  • 中文调性——Claude 全系中文文学性都不如 Qwen/GLM,和型号无关

Haiku 4.5:跑量专用,$5/M 的底线

Haiku 4.5 是 Claude 家族的「快餐线」:$1/$5、200K 上下文、速度 95 t/s。AA Intelligence 30——不高,但够做分类、摘要、短问答这类「不需要聪明」的任务。

适合 Haiku 的场景:

  • 分类和标签——情感分析、主题归类、内容审核,短输入短输出
  • 高并发场景——Haiku 的响应延迟最低,适合同时跑几十个并发
  • 简单摘要——单页文档、短邮件、社交媒体内容

Haiku 的硬伤: 200K 上下文在 2026 年算短的——其他 Claude 型号都是 1M。50 页 PDF 就可能触顶。 复杂指令理解弱于 Sonnet 5,偶尔会「自作主张」改需求。

如果不是「必须用 Claude」,做分类/摘要其实更推荐 GPT-5.4 Nano($0.20/$1.25、400K 上下文、HHEM 幻觉率 3.1% 全球第 2)——价格只有 Haiku 的 1/4,上下文还是 Haiku 的两倍。

Fast 变体:Opus 4.8 Fast 和 Opus 4.7 Fast

Anthropic 给 Opus 4.8 和 Opus 4.7 都提供了 Fast 变体——能力不变,速度更快,价格贵得多:

  • Opus 4.8 Fast:$10/$50——和 Fable 5 同价。能力是 Opus 4.8 级别(Intel 56),但 Fable 5(Intel 60)同价更强。基本没人会选 4.8 Fast 而非 Fable 5。
  • Opus 4.7 Fast:$30/$150——全场最贵。比 GPT-5.5 Pro($30/$180)便宜一点,但比所有非 Pro 旗舰贵一个数量级。OpenRouter 用量几乎为零(0.00T)。

结论:Fast 变体是「必须快 + 必须 Opus 质量」的极端场景才需要的产品。如果你需要低延迟,Sonnet 5 的 83 t/s 已经够快,价格只有 4.8 Fast 的 1/5。

Claude vs 竞品:同样的钱别家给什么

Claude 不是唯一选项。同样的预算,GPT、Gemini、国产模型能给什么?

Fable 5 ($50/M) vs GPT-5.6 Sol ($30/M)

Fable 5 的 AA Intelligence 60 全球第一,GPT-5.6 Sol 59 全球第二——只差 1 分。但 GPT-5.6 Sol 便宜 40%($30 vs $50 输出价)。 如果不是「必须全球第一」,GPT-5.6 Sol 的性价比更好。 Arena Text 里 GPT-5.6 Sol 的排名需要看最新数据,但 AA 上 1 分之差基本是统计误差范围。

Opus 4.8 ($25/M) vs GPT-5.6 Terra ($15/M)

Opus 4.8(Intel 56)比 GPT-5.6 Terra(Intel 55)高 1 分,但贵 67%($25 vs $15)。 GPT-5.6 Terra 速度 136 t/s 是 Opus 4.8(57 t/s)的 2.5 倍——速度差距巨大。 如果不需要 Claude 特有的输出风格,GPT-5.6 Terra 是 $15 价位的最优解。

Sonnet 5 ($10/M) vs GPT-5.5 ($30/M) vs Kimi K3 ($15/M)

Sonnet 5(Intel 53,$10/M)是这三者里性价比最高的。 GPT-5.5(Intel 55,$30/M)贵 3 倍、Intelligence 高 2 分。 Kimi K3(Intel 57,$15/M)Intelligence 最高、国内可用、但速度 62 t/s 比 Sonnet 5 的 83 t/s 慢不少。 国内直连选 Kimi K3,追求速度选 Sonnet 5,追求综合(不差钱)选 GPT-5.5。

Haiku 4.5 ($5/M) vs GPT-5.4 Nano ($1.25/M)

便宜任务直接选 GPT-5.4 Nano——$1.25/M 是 Haiku 的 1/4,400K 上下文是 Haiku 的两倍,HHEM 幻觉率 3.1% 全球第二。 Haiku 4.5 唯一优势是「已经是 Claude 生态、不想换供应商」。

Claude 全系 vs DeepSeek V4 Pro(价差 28 倍)

DeepSeek V4 Pro 输出 $0.87/M,Opus 4.8 输出 $25/M,价差 28 倍。 DeepSeek V4 Pro Intelligence 44 比 Opus 4.8 低 12 分,但价格差 28 倍。 如果场景在国内、且能接受国产模型的中文调性,DeepSeek 的性价比碾压 Claude。 但复杂代码任务上,Claude 的稳定性还是明显更好——这是 28 倍价差里的一部分溢价来源。

决策树:按场景选型号

写代码 / 重构 / Code Review

预算够 + 任务极复杂:Fable 5(Code Arena 1631 全球第一)
日常开发首选:Sonnet 5($10/M,Code Arena 1542,速度 83 t/s)
国内可用:Kimi K3($15/M,国内直连)或 DeepSeek V4 Pro($0.87/M)

Agent / 工具编排 / 多步骤任务

首选:Sonnet 5(性价比最优,5 步以内工具调用足够稳)
极复杂链路:Fable 5 或 Opus 4.8(10+ 步、有状态流转)
避免:Haiku 4.5(工具调用能力弱)

分类 / 标注 / 摘要(批量)

全场最优:GPT-5.4 Nano($1.25/M、HR 3.1%、400K ctx)
Claude 用户:Haiku 4.5($5/M、已是生态内最便宜)
不推荐:Fable 5 / Opus(杀鸡用牛刀,成本爆炸)

长文档分析(100+ 页)

首选:Sonnet 5 或 Opus 4.8(1M 上下文、$10-25/M)
最强准确:Fable 5(1M 上下文、$50/M)
避免:Haiku 4.5(200K 不够)

需要全球最强(研究 / 安全审计)

首选:Fable 5(AA 全球 #1,Arena Text/Code/Vision 均第一)
备选:GPT-5.6 Sol(AA 全球 #2,便宜 40%)
国产:Kimi K3(AA 57 全球 #3,$15/M,国内直连)

几个注意事项

  • 国内没有官方节点。Anthropic API 必须走代理或第三方中转(如 OpenRouter、硅基流动),延迟和稳定性受影响。如果国内直连是刚需,看 Kimi K3、DeepSeek V4 Pro、Qwen3.7 Max。
  • Haiku 4.5 的 200K 上下文是硬限制。超过会截断,不会报错。长文档场景务必先检查 token 数。
  • Opus 4.8 不一定比 Opus 4.7 「好」。Arena 数据显示用户更喜欢 4.7 的输出风格(Text 1494 vs 1476)。同价 $25/M,建议两个都试再决定。
  • Sonnet 4.6 已被 Sonnet 5 全面替代。Intelligence 34 vs 53、速度慢(43 vs 83 t/s)、还贵 50%($15 vs $10)。如果还在用 Sonnet 4.6,现在该换了。
  • Fast 变体的性价比极低。Opus 4.8 Fast($50/M)和 Fable 5($50/M)同价,但 Fable 5 更强。Opus 4.7 Fast($150/M)全场最贵。除非有明确 latency 刚需,否则别碰。
  • Claude 全系中文能力不如国产模型。写公文、小红书、公众号这类中文调性强的内容,Qwen3.7 Max 或 GLM-5.2 更合适,和选哪个 Claude 型号无关。