模型对比库
103 组主流 LLM 两两 PK:AA 评测、LMArena 排名、SuperCLUE 中文、API 价格、国内可用性逐项对比,配选型建议。 不替你算「综合分」,给你看每一项各自谁强。
国际线 · 顶级对决
国际线 · 主力 vs 旗舰
国际线 · 顶级 vs 长文档之王
国际线 · 长文档 vs 做题
国际线 · 主力对决
同家族升级
同家族 · Flash vs Pro
国内线 · 双雄对决
国内线 · 前端 vs 通用
国内线 · Moonshot vs 阿里
国内线 · 通用 vs 前端黑马
国内线 · 开源 vs 阿里云背书
国内线 · 智谱 vs 阿里
国内线 · Moonshot vs 小米黑马
国内线 · DeepSeek vs 小米黑马
跨境 · 国际主力 vs 国内旗舰
Claude Sonnet 4.6 国际线主力(OpenRouter 用量 #3),DeepSeek V4 Pro 国内 #2 + 便宜 4 倍 + 不用代理——预算紧 + 国内场景直接选 DeepSeek。
AA 智能/代码分接近(差 2 分以内),但 Kimi K2.6 便宜 4 倍 + 不用代理 + OpenRouter 用量都在第 2/3——国内开发场景 Kimi 是更高杠杆的选择。
跨境 · 国际旗舰 vs 国内 #1
undefined
Fable 5 做题 5 分更高但更贵、速度更快;Opus 4.8 综合更均衡,适合需要稳定输出的场景
Anthropic 新模型 vs Google 新模型:Fable 5 强推理,Gemini 3.5 Flash 性价比惊人
Anthropic 最新 vs OpenAI 最新:Fable 5 推理激进速度快,GPT-5.5 做题更高但更贵
Google 两款图像模型:Flash Image(Nano Banana 2) 便宜快速,Pro Image 质量更高
Meta 旗舰 vs 新秀:Maverick 通用强,Muse Spark 为开源社区新选项
Flash Lite 是 Gemini 最便宜款($0.25/$1.5),跑量成本优先;3.5 Flash 智能 55 全球第 6、速度最快,要智能和吞吐选 3.5
GPT-5.5 $5/$30 是主力通用款;GPT-5.5 Pro $30/$180 是顶配旗舰,专攻高风险高准确性任务,普通场景用 Pro 是浪费钱
两者都是旗舰档:GPT-5.5 Pro $30/$180 主打高风险推理,Claude Opus 4.8 AA 智能 56 全球第 2、综合更均衡
AA 前两名正面交锋:Fable 5 Intelligence 60、输出 $50/M;GPT-5.6 Sol (max) 59、$30/M。Fable 5 贵 67% 但高 1 分,Sol 性价比更优
Anthropic 旗舰 vs xAI 黑马:Fable 5 (60) 比 Grok 4.5 (54) 高 6 分,但 Grok 输出 $6/M 只有 Fable 的 12%。预算紧选 Grok,要极致选 Fable
OpenAI 旗舰 vs xAI 旗舰:Sol (max) 59、$30/M;Grok 4.5 (high) 54、$6/M。Sol 高 5 分但贵 5 倍,Grok 性价比碾压
美国旗舰 vs 中国旗舰:Sol (max) 59、$30/M;GLM-5.2 (max) 51、$1.10/M。GLM 便宜 27 倍,Intelligence 差 8 分——国内直连场景 GLM 更划算
全球第一 vs 国产第一:Fable 5 (60) 比 GLM-5.2 (51) 高 9 分,但 GLM 输出 $1.10 只有 Fable 的 2%。国内场景 GLM 性价比无敌
中档旗舰 vs 顶配旗舰:Sonnet 5 (53) $10/M、Sol (max) 59 $30/M。Sol 高 6 分贵 3 倍——需要极致选 Sol,平衡选 Sonnet
国产旗舰对决:V4 Pro (44) $0.87/M、GLM-5.2 (51) $1.10/M。GLM 高 7 分贵 26%——中文场景 GLM 更强,纯跑量 V4 Pro 更便宜
国产旗舰正面刚:GLM-5.2 (51) $1.10/M、Kimi K2.6 (46) $3.41/M。GLM 高 5 分便宜 67%——目前国产性价比之王是 GLM
闭源旗舰 vs 开源旗舰:Fable 5 (60) $50/M、Qwen3.7 Max (47) $3.90/M。Fable 高 13 分贵 13 倍——要私有化部署选 Qwen
中档对决:Terra (max) 55、$15/M;Sonnet 5 53、$10/M。Terra 高 2 分贵 50%——OpenAI 生态选 Terra,成本敏感选 Sonnet
同家族 · 标准 vs 高速
同家族 · 7 天迭代
跨境 · 国际顶级 vs 国内 #1
跨境 · 国际顶级 vs 速度甜点
跨境 · 国际顶级 vs OpenAI 长文档中档
跨境 · 国际顶级 vs 国内 AA #1
同家族 · 高速顶配 vs 主力性价比
同家族 · 新旗舰 vs 老主力
跨境 · 国际新王 vs 国内 #1
跨境 · 国际新王 vs 速度甜点
国际线 · 新王 vs 旧王
国际线 · 主力 vs 速度甜点
国际线 · OpenAI 新主力 vs Claude 主力
跨境 · xAI 性价比 vs Claude 主力
国内线 · 地板价跑量 vs 字节黑马
跨境 · 极致便宜档对决
国内线 · 最便宜 Top 10 对决
跑量场景 · 便宜 vs 免费
国内线 · 平价档对决
国内线 · 地板价对决
跨境 · 国内 #1 vs 长文档之王
跨境 · 国内性价比 vs 国际速度型
跨境 · 国际中档 vs 国内旗舰
跨境 · 国内 #1 vs 国际旗舰
跨境 · 性价比之王对决
国内线 · 性价比之王 vs 质量天花板
国产线 · 开源性价比 vs MoE 新贵
同家族 · Pro vs Flash
跨境 · 长文档之王 vs xAI 性价比黑马
跨境 · 长文档 vs 国内 AA #1
跨境 · 国际长文档 vs 国内速度王
国际线 · 速度甜点 vs 做题王
跨境 · Google 速度型 vs xAI 性价比
国际线 · 轻量档对决
同家族 · 智谱升级
同家族 · GLM 5.1 vs 5.2
同家族 · OpenAI 主力升级
国际线 · xAI 黑马 vs OpenAI 新主力
跨境 · 国际旗舰 vs 国内最强
跨境 · xAI 性价比 vs 国内综合
国产线 · 老牌旗舰 vs 6 月新秀
国内线 · 旧王 vs 新王
同家族 · 开源长文档怪兽 vs 通用主力
国内线 · 小米 Agent 黑马 vs 阿里背书
同家族 · 阿里升级
同家族 · Preview 到正式版
国产 Agent 模型 · 腾讯 vs 深度求索
国产 Agent 模型 · 腾讯 vs 阿里
同家族 · 图像生成旗舰对比
同家族 · 生图 Pro vs Flash
同底座 · 生图 vs 纯文本
换代 · OpenAI 旗舰
同系列 · 5.6 内部档位
换代 · Grok 旗舰
所有对比的数据来自多个独立数据源:LMArena、SuperCLUE、OpenRouter 用量与价格、Vectara HHEM 幻觉率、MathArena 数学竞赛等。每页都标注抓取日期,数据缺失透明可见。