Grok 4.3

xAI

xAI 的性价比旗舰,输出快、价格低,跑量不心疼

发布日期:2026-04-30 · 覆盖数据源:2 / 6 (Arena · Pricing)

xAI 4 月底发布的旗舰。AA Intelligence 53.2 全球第 7,输出价只要 $2.5/M,比同档模型便宜一半以上。速度 94.5 token/s,比 Claude Opus 快近 70%。LMArena Text 也能看到 Grok-4.20-beta1 排到第 9,说明人类盲测里表现不差。缺点是 Coding Index 41.0,全球前 12 里倒数第二,写复杂代码不是强项。SuperCLUE 3 月榜收录的是 Grok-4.20-Beta 旧版本,4.3 的新成绩待下次更新。

关键指标

输出价格
$2.50
/ 百万 token

LMArena · 人类盲测排名

arena.ai · 抓取于 2026-07-21
分类 最佳变体 排名 Elo
🔍 Search grok-4.20-multi-agent-beta-0309 #11 1205.8523051891902
🏆 Overall grok-4.20-beta1 #20 1474.2502503083822
📄 Document grok-4.20-beta-0309-reasoning #27 1413.1257367324329
👁️ Vision grok-4.20-beta-0309-reasoning #28 1252.7788233597923

只展示 Top 10 内出现的分类与变体。同一分类下若有多个变体(thinking / search 等),只显示排名最靠前的。 LMArena 是 Elo 分,人类盲测两两投票算出来—— 「人类觉得好」≠「客观最强」,但反映真实使用体验。

SuperCLUE · 中文能力测评

未收录:SuperCLUE 5 月榜 Grok-4.3 总分 55.54,海外模型中垫底,中文场景不推荐。

API 价格与国内可用性

来源 openrouter.ai · 抓取于 2026-07-22
输入价格 $1.25 / 百万 token
输出价格 $2.50 / 百万 token
上下文窗口 1000K tokens
国内可用性 需代理
最近核验 2026-07-18T04:14:04.167577+08:00
同档对手价格
模型 输入 输出 国内
Amazon: Nova 2 Lite · $0.30 $2.50
Google: Nano Banana (Gemini 2.5 Flash Image) · $0.30 $2.50
Google: Gemini 3.5 Flash-Lite · $0.30 $2.50
MoonshotAI: Kimi K2 0905 · $0.60 $2.50

Vectara HHEM · 幻觉率实测

未收录:Vectara HHEM-2.3 排行榜(2026-07-02T04:24:22.584572+08:00 版)尚未收录该模型,幻觉率数据待官方补入后接入。

什么时候选它 / 别选它

适合场景
  • 日常对话、内容生成、简单脚本——速度快、价格低,跑量不心疼
  • 需要 X 平台实时数据接入的场景
  • 预算敏感但对智能要求不极端的任务
不适合场景
  • 复杂代码任务——Coding Index 41.0,远低于 GPT-5.3 Codex 的 53.1
  • 国内无代理环境——xAI API 没有大陆节点
  • 需要极高 Agent 编排精度的任务——Agentic 65.89 不错但不是顶级

不选它的话,看看这些

Grok 4.3 常被拿来比的对