Claude 家族怎么选?Fable 5 / Opus 4.8 / Sonnet 5 / Haiku 4.5 实测对比
Anthropic 当前在售的 Claude 有四个主力型号:Fable 5(全球 AA 第一)、Opus 4.8(老旗舰降价了)、Sonnet 5(性价比最高)、Haiku 4.5(便宜够用)。 价格从 $5/M 到 $50/M 差 10 倍。该买哪个?直接看数据。
一句话结论
大多数人应该用 Sonnet 5。 AA Intelligence 53、速度 83 t/s、输出价 $10/M——比老旗舰 Opus 4.7 便宜 60%,比 Fable 5 便宜 80%。写代码、做 Agent、日常对话都够用。OpenRouter 上周跑了 0.94T token,和 Opus 4.6 用量持平。
Fable 5 是目前全球最强模型。 AA Intelligence 60 排全球第一(超过 GPT-5.6 Sol 的 59),Arena Text 1507 也是第一。但 $10/$50 的定价也是顶配。只有「必须用最强」的场景才值得花这个钱——比如顶级研究报告、复杂代码审查、高难度 Agent 编排。
Opus 4.8 是「降价老旗舰」。 AA Intelligence 56,比 Fable 5 低 4 分,但价格只有 Fable 5 的一半($5/$25)。Arena Text 1476 比 Opus 4.7 的 1494 还低——有意思的是用户更喜欢 4.7 的输出风格。如果不需要极致智能,Opus 4.8 的 $5/$25 是旗舰档里最便宜的。
Haiku 4.5 适合跑量。 $1/$5、AA Intelligence 30、速度 105 t/s。做分类、摘要、短问答很合适。200K 上下文在 2026 年算短的——长文档别用它。
主力型号参数对照
| 型号 | AA Intel | 速度 t/s | 上下文 | 输出价 /M | Arena Text |
|---|---|---|---|---|---|
| Fable 5 全球 #1 | 60 | 62 | 1M | $50 | 1507 |
| Opus 4.8 当前旗舰 | 56 | 60 | 1M | $25 | 1476 |
| Sonnet 5 性价比王 | 53 | 83 | 1M | $10 | 1461 |
| Haiku 4.5 轻量跑量 | 30 | 105 | 200K | $5 | — |
| Opus 4.7 上一代旗舰 | — | 50 | 1M | $25 | 1494 |
| Sonnet 4.6 上一代主力 | 34 (Low Effort) | 43 | 1M | $15 | 1471 |
数据来源:Artificial Analysis(2026-07-21)、Arena Text Elo。灰色行是上一代型号,仍在售但已被新型号全面超越。Opus 4.7 的 Arena Text 1494 高于 Opus 4.8 的 1476——用户在投票中偏好 4.7 的输出风格。
Fable 5:全球最强,但 90% 的人不需要
Claude Fable 5 的 AA Intelligence 60 是全球第一——超过 GPT-5.6 Sol 的 59、Kimi K3 的 57、Opus 4.8 的 56。Arena Text 1507 也是全球第一,Code Arena 1631 同样第一。Vision 1318 第一,Document 1507 并列第一。
简单说:Fable 5 在几乎所有主流维度上都是当前最强。
但价格也顶配:$10 输入 / $50 输出每百万 token。写 4000 字(约 3000 token 输出)花 $0.15,跑 1000 次就是 $150。对比 Sonnet 5 的 $2/$10,Fable 5 输出价贵 5 倍。
值得上 Fable 5 的场景:
- 高难度代码审查——跨 5+ 文件的大型 refactor、安全漏洞分析
- 复杂 Agent 编排——调用 5+ 个工具、有状态流转、需要长链路推理
- 研究报告 / 法律分析——需要极强准确性的长文档结构化分析
- 「跑一次值回票价」的高难任务——不是日常跑量
不值得上 Fable 5 的场景:
- 日常对话、客服问答——Sonnet 5 完全够用,便宜 5 倍
- 批量分类/标注/摘要——Haiku 4.5 或 Sonnet 5 效果差不到 10%、价格便宜 5-10 倍
- 普通写代码——Sonnet 5 的 Code Arena 1542 已经很强,Fable 5 的 1631 主要赢在极端复杂任务
一个有意思的细节: Fable 5 在 AA 的名字是「Claude Fable 5 (with fallback)」——「with fallback」意味着它可能内置了降级机制(遇到错误自动回退到安全输出),这可能是它 AA 分数特别高的原因之一。如果你需要的是「更聪明但可能犯错」vs「更保守但更准确」,Fable 5 显然是后者。
Opus 4.8:降价老旗舰,$25/M 的旗舰档门票
Opus 4.8 的 AA Intelligence 56,全球第四。比 Fable 5 低 4 分,但价格只有 Fable 5 的一半($5/$25 vs $10/$50)。
但有个反直觉的现象:Opus 4.8 的 Arena Text 分数(1476)比上一代 Opus 4.7(1494)还低 18 分。同样地,Opus 4.8 thinking 的 Document 分数(1475)低于 Opus 4.6 thinking(1508)。
这说明什么?用户更喜欢旧版的输出风格。可能是 4.8 的 RLHF 调优方向变了,也可能是 Fable 5 的「fallback 机制」在底层影响了输出。如果你对输出风格有偏好,建议先试 Opus 4.7(同价 $5/$25),再决定要不要升级到 4.8。
Opus 4.8 的甜蜜点:
- 需要旗舰级能力但预算有限——$25/M 是旗舰档最低价(对比 GPT-5.6 Sol 的 $30/M)
- 代码生成——Opus 4.8 Code 1534、Code thinking 1562,仍然是 Claude 家族代码能力前三
- 长文档分析——1M 上下文全吃下,法律合同、医学文献、审计报告
别买 Opus 4.8 的场景:
- 日常开发——Sonnet 5 便宜 60%($10 vs $25),代码能力差距不大
- 追求最快响应——Opus 4.8 速度只有 57 t/s,Sonnet 5 是 83 t/s
- 追求最强——Fable 5 全面碾压,且同价($50/M 输出)
Sonnet 5:性价比王,开发者的默认选择
Sonnet 5 的 AA Intelligence 53、速度 83 t/s、输出价 $10/M——这三个数字放在一起,是 Claude 家族里性价比最高的组合。
对比几个参照物:
- 比 Opus 4.8 便宜 60%($10 vs $25),Intelligence 只低 3 分(53 vs 56)
- 比 Opus 4.7 便宜 60%($10 vs $25),Intelligence 反而更高(53 vs 54,几乎一样)
- 比 Sonnet 4.6 便宜 33%($10 vs $15),Intelligence 高 19 分(53 vs 34)
- 比 Fable 5 便宜 80%($10 vs $50),Intelligence 低 7 分(53 vs 60)
OpenRouter 上周用量 0.94T token,和 Opus 4.6(0.94T)持平。开发者用脚投票:Sonnet 5 已经是新的主力。
速度 83 t/s 在 Claude 家族里仅次于 Haiku 4.5(95 t/s),是 Opus 4.8(57 t/s)的 1.6 倍。日常开发体感明显更快。
Sonnet 5 适合的场景:
- 日常写代码 / Code Review——性价比最优,Code Arena 1542
- Agent 工具调用——2-5 步工具编排足够稳,不用花 Opus 的钱
- 文档分析 / 摘要——1M 上下文,$10/M 跑得起量
- 客服 / 对话——比 Haiku 聪明很多,价格只贵一倍
Sonnet 5 不够的场景:
- 极复杂推理(10+ 步规划)——偶尔会「忘记」早期约束,这种场景上 Opus
- 必须最强——研究级分析、高难度安全审计,Fable 5 更靠谱
- 中文调性——Claude 全系中文文学性都不如 Qwen/GLM,和型号无关
Haiku 4.5:跑量专用,$5/M 的底线
Haiku 4.5 是 Claude 家族的「快餐线」:$1/$5、200K 上下文、速度 95 t/s。AA Intelligence 30——不高,但够做分类、摘要、短问答这类「不需要聪明」的任务。
适合 Haiku 的场景:
- 分类和标签——情感分析、主题归类、内容审核,短输入短输出
- 高并发场景——Haiku 的响应延迟最低,适合同时跑几十个并发
- 简单摘要——单页文档、短邮件、社交媒体内容
Haiku 的硬伤: 200K 上下文在 2026 年算短的——其他 Claude 型号都是 1M。50 页 PDF 就可能触顶。 复杂指令理解弱于 Sonnet 5,偶尔会「自作主张」改需求。
如果不是「必须用 Claude」,做分类/摘要其实更推荐 GPT-5.4 Nano($0.20/$1.25、400K 上下文、HHEM 幻觉率 3.1% 全球第 2)——价格只有 Haiku 的 1/4,上下文还是 Haiku 的两倍。
Fast 变体:Opus 4.8 Fast 和 Opus 4.7 Fast
Anthropic 给 Opus 4.8 和 Opus 4.7 都提供了 Fast 变体——能力不变,速度更快,价格贵得多:
- Opus 4.8 Fast:$10/$50——和 Fable 5 同价。能力是 Opus 4.8 级别(Intel 56),但 Fable 5(Intel 60)同价更强。基本没人会选 4.8 Fast 而非 Fable 5。
- Opus 4.7 Fast:$30/$150——全场最贵。比 GPT-5.5 Pro($30/$180)便宜一点,但比所有非 Pro 旗舰贵一个数量级。OpenRouter 用量几乎为零(0.00T)。
结论:Fast 变体是「必须快 + 必须 Opus 质量」的极端场景才需要的产品。如果你需要低延迟,Sonnet 5 的 83 t/s 已经够快,价格只有 4.8 Fast 的 1/5。
Claude vs 竞品:同样的钱别家给什么
Claude 不是唯一选项。同样的预算,GPT、Gemini、国产模型能给什么?
Fable 5 ($50/M) vs GPT-5.6 Sol ($30/M)
Fable 5 的 AA Intelligence 60 全球第一,GPT-5.6 Sol 59 全球第二——只差 1 分。但 GPT-5.6 Sol 便宜 40%($30 vs $50 输出价)。 如果不是「必须全球第一」,GPT-5.6 Sol 的性价比更好。 Arena Text 里 GPT-5.6 Sol 的排名需要看最新数据,但 AA 上 1 分之差基本是统计误差范围。
Opus 4.8 ($25/M) vs GPT-5.6 Terra ($15/M)
Opus 4.8(Intel 56)比 GPT-5.6 Terra(Intel 55)高 1 分,但贵 67%($25 vs $15)。 GPT-5.6 Terra 速度 136 t/s 是 Opus 4.8(57 t/s)的 2.5 倍——速度差距巨大。 如果不需要 Claude 特有的输出风格,GPT-5.6 Terra 是 $15 价位的最优解。
Sonnet 5 ($10/M) vs GPT-5.5 ($30/M) vs Kimi K3 ($15/M)
Sonnet 5(Intel 53,$10/M)是这三者里性价比最高的。 GPT-5.5(Intel 55,$30/M)贵 3 倍、Intelligence 高 2 分。 Kimi K3(Intel 57,$15/M)Intelligence 最高、国内可用、但速度 62 t/s 比 Sonnet 5 的 83 t/s 慢不少。 国内直连选 Kimi K3,追求速度选 Sonnet 5,追求综合(不差钱)选 GPT-5.5。
Haiku 4.5 ($5/M) vs GPT-5.4 Nano ($1.25/M)
便宜任务直接选 GPT-5.4 Nano——$1.25/M 是 Haiku 的 1/4,400K 上下文是 Haiku 的两倍,HHEM 幻觉率 3.1% 全球第二。 Haiku 4.5 唯一优势是「已经是 Claude 生态、不想换供应商」。
Claude 全系 vs DeepSeek V4 Pro(价差 28 倍)
DeepSeek V4 Pro 输出 $0.87/M,Opus 4.8 输出 $25/M,价差 28 倍。 DeepSeek V4 Pro Intelligence 44 比 Opus 4.8 低 12 分,但价格差 28 倍。 如果场景在国内、且能接受国产模型的中文调性,DeepSeek 的性价比碾压 Claude。 但复杂代码任务上,Claude 的稳定性还是明显更好——这是 28 倍价差里的一部分溢价来源。
决策树:按场景选型号
预算够 + 任务极复杂:Fable 5(Code Arena 1631 全球第一)
日常开发首选:Sonnet 5($10/M,Code Arena 1542,速度 83 t/s)
国内可用:Kimi K3($15/M,国内直连)或 DeepSeek V4 Pro($0.87/M)
首选:Sonnet 5(性价比最优,5 步以内工具调用足够稳)
极复杂链路:Fable 5 或 Opus 4.8(10+ 步、有状态流转)
避免:Haiku 4.5(工具调用能力弱)
全场最优:GPT-5.4 Nano($1.25/M、HR 3.1%、400K ctx)
Claude 用户:Haiku 4.5($5/M、已是生态内最便宜)
不推荐:Fable 5 / Opus(杀鸡用牛刀,成本爆炸)
首选:Sonnet 5 或 Opus 4.8(1M 上下文、$10-25/M)
最强准确:Fable 5(1M 上下文、$50/M)
避免:Haiku 4.5(200K 不够)
首选:Fable 5(AA 全球 #1,Arena Text/Code/Vision 均第一)
备选:GPT-5.6 Sol(AA 全球 #2,便宜 40%)
国产:Kimi K3(AA 57 全球 #3,$15/M,国内直连)
几个注意事项
- 国内没有官方节点。Anthropic API 必须走代理或第三方中转(如 OpenRouter、硅基流动),延迟和稳定性受影响。如果国内直连是刚需,看 Kimi K3、DeepSeek V4 Pro、Qwen3.7 Max。
- Haiku 4.5 的 200K 上下文是硬限制。超过会截断,不会报错。长文档场景务必先检查 token 数。
- Opus 4.8 不一定比 Opus 4.7 「好」。Arena 数据显示用户更喜欢 4.7 的输出风格(Text 1494 vs 1476)。同价 $25/M,建议两个都试再决定。
- Sonnet 4.6 已被 Sonnet 5 全面替代。Intelligence 34 vs 53、速度慢(43 vs 83 t/s)、还贵 50%($15 vs $10)。如果还在用 Sonnet 4.6,现在该换了。
- Fast 变体的性价比极低。Opus 4.8 Fast($50/M)和 Fable 5($50/M)同价,但 Fable 5 更强。Opus 4.7 Fast($150/M)全场最贵。除非有明确 latency 刚需,否则别碰。
- Claude 全系中文能力不如国产模型。写公文、小红书、公众号这类中文调性强的内容,Qwen3.7 Max 或 GLM-5.2 更合适,和选哪个 Claude 型号无关。