GLM 5.1
Z.ai (智谱) · 🇨🇳前端工程黑马——LMArena WebDev 第 5 名,比 Claude Sonnet 还前面
发布日期:2026-04-07 · 覆盖数据源:2 / 6 (Arena · Pricing)
智谱 AI 当前旗舰。最显眼的一条数据:LMArena WebDev Arena 排到第 5 名(1531 分),把 Claude Sonnet 4.6(第 6)和 GPT-5.5(第 9)都甩在身后——前端代码人类盲测能打过 GPT 系列,国内独一份。但同一个模型在 AA Coding Index 只有 43.37,国内榜第 5——「做题分」和「实际写前端能力」严重背离的典型。AA Intelligence 51.41、Agentic 67.05。$0.98/M 输入、$3.08/M 输出。
关键指标
输出价格
$3.04
/ 百万 token
LMArena · 人类盲测排名
arena.ai · 抓取于 2026-07-21| 分类 | 最佳变体 | 排名 | Elo |
|---|---|---|---|
| 💻 Code | glm-5.1 | #15 | 1526.4944097074892 |
| 🏆 Overall | glm-5.1 | #27 | 1470.7411900586292 |
只展示 Top 10 内出现的分类与变体。同一分类下若有多个变体(thinking / search 等),只显示排名最靠前的。 LMArena 是 Elo 分,人类盲测两两投票算出来—— 「人类觉得好」≠「客观最强」,但反映真实使用体验。
SuperCLUE · 中文能力测评
未收录:SuperCLUE 5 月榜 GLM-5.1 总分 63.24,国内第五(并列)。
API 价格与国内可用性
来源 openrouter.ai · 抓取于 2026-07-22| 输入价格 | $0.97 / 百万 token |
| 输出价格 | $3.04 / 百万 token |
| 上下文窗口 | 203K tokens |
| 国内可用性 | 可用 |
| 最近核验 | 2026-07-18T04:14:04.167577+08:00 |
同档对手价格
| 模型 | 输入 | 输出 | 国内 |
|---|---|---|---|
| Gemini 3 Flash Preview · Google | $0.50 | $3.00 | 不稳定 |
| Gemini 3.1 Flash Image (Nano Banana 2) · Google | $0.50 | $3.00 | 需代理 |
| Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview) · | $0.50 | $3.00 | |
| Nous: Hermes 4 405B · | $1.00 | $3.00 |
Vectara HHEM · 幻觉率实测
未收录:Vectara HHEM-2.3 排行榜(2026-07-02T04:24:22.584572+08:00 版)尚未收录该模型,幻觉率数据待官方补入后接入。
什么时候选它 / 别选它
适合场景
- 前端 UI 开发、React/Vue 组件生成——人类盲测能赢 GPT-5.5
- 国内合规场景需要稳定 API 的——智谱开放平台支持发票/合同
- Agent 任务(Agentic 67.05 国内前列)
不适合场景
- 纯做题/复杂数学——AA Coding 才 43.37,低于 Kimi/DeepSeek
- 对响应速度有要求的——AA 实测 56.8 token/s 中规中矩
- OpenRouter 用量没进前 10——开发者圈认知度还在爬升