模型对比库

103 组主流 LLM 两两 PK:AA 评测、LMArena 排名、SuperCLUE 中文、API 价格、国内可用性逐项对比,配选型建议。 不替你算「综合分」,给你看每一项各自谁强。

国际线 · 顶级对决

国际线 · 主力 vs 旗舰

国际线 · 顶级 vs 长文档之王

国际线 · 长文档 vs 做题

国际线 · 主力对决

同家族升级

同家族 · Flash vs Pro

国内线 · 双雄对决

国内线 · 前端 vs 通用

国内线 · Moonshot vs 阿里

国内线 · 通用 vs 前端黑马

国内线 · 开源 vs 阿里云背书

国内线 · 智谱 vs 阿里

国内线 · Moonshot vs 小米黑马

国内线 · DeepSeek vs 小米黑马

跨境 · 国际主力 vs 国内旗舰

跨境 · 国际旗舰 vs 国内 #1

undefined

Claude Fable 5
vs
Claude Opus 4.8

Fable 5 做题 5 分更高但更贵、速度更快;Opus 4.8 综合更均衡,适合需要稳定输出的场景

Anthropic · Anthropic
Claude Fable 5
vs
Gemini 3.5 Flash

Anthropic 新模型 vs Google 新模型:Fable 5 强推理,Gemini 3.5 Flash 性价比惊人

Anthropic · Google
Claude Fable 5
vs
GPT-5.5

Anthropic 最新 vs OpenAI 最新:Fable 5 推理激进速度快,GPT-5.5 做题更高但更贵

Anthropic · OpenAI
Gemini 3.1 Flash Image
vs
Gemini 3 Pro Image

Google 两款图像模型:Flash Image(Nano Banana 2) 便宜快速,Pro Image 质量更高

Google · Google
Llama 4 Maverick
vs
Muse Spark

Meta 旗舰 vs 新秀:Maverick 通用强,Muse Spark 为开源社区新选项

Meta · Meta
Claude Opus 4.7
vs
Claude Sonnet 5

Anthropic · Anthropic
Claude Fable 5
vs
Claude Sonnet 5

Anthropic · Anthropic
Poolside Laguna XS 2.1
vs
DeepSeek V4 Flash

Poolside · DeepSeek · 🇨🇳
NVIDIA Nemotron 3 Ultra
vs
Qwen3.7 Plus

NVIDIA · Alibaba · 🇨🇳
Sakana Fugu Ultra
vs
Claude Opus 4.8

Sakana AI · Anthropic
Gemini 3.1 Flash Lite Image
vs
Gemini 3 Pro Image

Google · Google
Gemini 3.1 Flash Lite
vs
Gemini 3.5 Flash

Flash Lite 是 Gemini 最便宜款($0.25/$1.5),跑量成本优先;3.5 Flash 智能 55 全球第 6、速度最快,要智能和吞吐选 3.5

Google · Google
GPT-5.5
vs
GPT-5.5 Pro

GPT-5.5 $5/$30 是主力通用款;GPT-5.5 Pro $30/$180 是顶配旗舰,专攻高风险高准确性任务,普通场景用 Pro 是浪费钱

OpenAI · OpenAI
Claude Opus 4.8
vs
GPT-5.5 Pro

两者都是旗舰档:GPT-5.5 Pro $30/$180 主打高风险推理,Claude Opus 4.8 AA 智能 56 全球第 2、综合更均衡

Anthropic · OpenAI
Claude Fable 5
vs
GPT-5.6 Sol

AA 前两名正面交锋:Fable 5 Intelligence 60、输出 $50/M;GPT-5.6 Sol (max) 59、$30/M。Fable 5 贵 67% 但高 1 分,Sol 性价比更优

Anthropic · OpenAI
Claude Fable 5
vs
Grok 4.5

Anthropic 旗舰 vs xAI 黑马:Fable 5 (60) 比 Grok 4.5 (54) 高 6 分,但 Grok 输出 $6/M 只有 Fable 的 12%。预算紧选 Grok,要极致选 Fable

Anthropic · xAI
GPT-5.6 Sol
vs
Grok 4.5

OpenAI 旗舰 vs xAI 旗舰:Sol (max) 59、$30/M;Grok 4.5 (high) 54、$6/M。Sol 高 5 分但贵 5 倍,Grok 性价比碾压

OpenAI · xAI
GLM 5.2
vs
GPT-5.6 Sol

美国旗舰 vs 中国旗舰:Sol (max) 59、$30/M;GLM-5.2 (max) 51、$1.10/M。GLM 便宜 27 倍,Intelligence 差 8 分——国内直连场景 GLM 更划算

Z.ai (智谱) · 🇨🇳 · OpenAI
Claude Fable 5
vs
GLM 5.2

全球第一 vs 国产第一:Fable 5 (60) 比 GLM-5.2 (51) 高 9 分,但 GLM 输出 $1.10 只有 Fable 的 2%。国内场景 GLM 性价比无敌

Anthropic · Z.ai (智谱) · 🇨🇳
Claude Sonnet 5
vs
GPT-5.6 Sol

中档旗舰 vs 顶配旗舰:Sonnet 5 (53) $10/M、Sol (max) 59 $30/M。Sol 高 6 分贵 3 倍——需要极致选 Sol,平衡选 Sonnet

Anthropic · OpenAI
DeepSeek V4 Pro
vs
GLM 5.2

国产旗舰对决:V4 Pro (44) $0.87/M、GLM-5.2 (51) $1.10/M。GLM 高 7 分贵 26%——中文场景 GLM 更强,纯跑量 V4 Pro 更便宜

DeepSeek · 🇨🇳 · Z.ai (智谱) · 🇨🇳
GLM 5.2
vs
Kimi K2.6

国产旗舰正面刚:GLM-5.2 (51) $1.10/M、Kimi K2.6 (46) $3.41/M。GLM 高 5 分便宜 67%——目前国产性价比之王是 GLM

Z.ai (智谱) · 🇨🇳 · Moonshot AI · 🇨🇳
Claude Fable 5
vs
Qwen3.7 Max

闭源旗舰 vs 开源旗舰:Fable 5 (60) $50/M、Qwen3.7 Max (47) $3.90/M。Fable 高 13 分贵 13 倍——要私有化部署选 Qwen

Anthropic · Alibaba · 🇨🇳
Claude Sonnet 5
vs
GPT-5.6 Terra

中档对决:Terra (max) 55、$15/M;Sonnet 5 53、$10/M。Terra 高 2 分贵 50%——OpenAI 生态选 Terra,成本敏感选 Sonnet

Anthropic · OpenAI
Claude Fable 5
vs
Kimi K3

Anthropic · Moonshot AI · 🇨🇳
GPT-5.6 Sol
vs
Kimi K3

OpenAI · Moonshot AI · 🇨🇳
Kimi K2.6
vs
Kimi K3

Moonshot AI · 🇨🇳 · Moonshot AI · 🇨🇳
GLM 5.2
vs
Kimi K3

Z.ai (智谱) · 🇨🇳 · Moonshot AI · 🇨🇳
DeepSeek V4 Pro
vs
Kimi K3

DeepSeek · 🇨🇳 · Moonshot AI · 🇨🇳
Grok 4.5
vs
Kimi K3

xAI · Moonshot AI · 🇨🇳

同家族 · 标准 vs 高速

同家族 · 7 天迭代

跨境 · 国际顶级 vs 国内 #1

跨境 · 国际顶级 vs 速度甜点

跨境 · 国际顶级 vs OpenAI 长文档中档

跨境 · 国际顶级 vs 国内 AA #1

同家族 · 高速顶配 vs 主力性价比

同家族 · 新旗舰 vs 老主力

跨境 · 国际新王 vs 国内 #1

跨境 · 国际新王 vs 速度甜点

国际线 · 新王 vs 旧王

国际线 · 主力 vs 速度甜点

国际线 · OpenAI 新主力 vs Claude 主力

跨境 · xAI 性价比 vs Claude 主力

国内线 · 地板价跑量 vs 字节黑马

跨境 · 极致便宜档对决

国内线 · 最便宜 Top 10 对决

跑量场景 · 便宜 vs 免费

国内线 · 平价档对决

国内线 · 地板价对决

跨境 · 国内 #1 vs 长文档之王

跨境 · 国内性价比 vs 国际速度型

跨境 · 国际中档 vs 国内旗舰

跨境 · 国内 #1 vs 国际旗舰

跨境 · 性价比之王对决

国内线 · 性价比之王 vs 质量天花板

国产线 · 开源性价比 vs MoE 新贵

同家族 · Pro vs Flash

跨境 · 长文档之王 vs xAI 性价比黑马

跨境 · 长文档 vs 国内 AA #1

跨境 · 国际长文档 vs 国内速度王

国际线 · 速度甜点 vs 做题王

跨境 · Google 速度型 vs xAI 性价比

国际线 · 轻量档对决

同家族 · 智谱升级

同家族 · GLM 5.1 vs 5.2

同家族 · OpenAI 主力升级

国际线 · xAI 黑马 vs OpenAI 新主力

跨境 · 国际旗舰 vs 国内最强

跨境 · xAI 性价比 vs 国内综合

国产线 · 老牌旗舰 vs 6 月新秀

国内线 · 旧王 vs 新王

同家族 · 开源长文档怪兽 vs 通用主力

国内线 · 小米 Agent 黑马 vs 阿里背书

同家族 · 阿里升级

同家族 · Preview 到正式版

国产 Agent 模型 · 腾讯 vs 深度求索

国产 Agent 模型 · 腾讯 vs 阿里

同家族 · 图像生成旗舰对比

同家族 · 生图 Pro vs Flash

同底座 · 生图 vs 纯文本

换代 · OpenAI 旗舰

同系列 · 5.6 内部档位

换代 · Grok 旗舰

所有对比的数据来自多个独立数据源:LMArena、SuperCLUE、OpenRouter 用量与价格、Vectara HHEM 幻觉率、MathArena 数学竞赛等。每页都标注抓取日期,数据缺失透明可见。

想看单个模型详情?去 模型库。 想看按场景的选型建议?去 指南