Gemini 3 Flash Preview

Google

Google 最快最便宜的模型,182 token/s + 1M 上下文,速度优先首选

发布日期:2025-12-17 · 覆盖数据源:3 / 6 (Arena · Pricing · HHEM)

Google 的「速度旗舰」。AA Intelligence 46.43(全美第 9),不算顶尖但够用。真正的卖点是速度:输出 182.0 token/s,全场最快之一,比 Claude Opus 4.7 快 3 倍。输入 $0.5/M、输出 $3/M,比 Gemini 3.1 Pro Preview 便宜 75%。1M 上下文和 Pro 一样长。LMArena Search 场景里「gemini-3-flash-grounding」排到第 9,说明在带搜索的问答上表现不错。

关键指标

输出价格
$3.00
/ 百万 token

LMArena · 人类盲测排名

arena.ai · 抓取于 2026-07-21
分类 最佳变体 排名 Elo
🔍 Search gemini-3-flash-grounding #13 1196.357923508813
🌐 Web Dev gemini-3-flash #18 1456.6673281872695
👁️ Vision gemini-3-flash #20 1271.247037702312
🏆 Overall gemini-3-flash #22 1473.1528456754743
📄 Document gemini-3-flash #28 1412.7822584977862
💻 Code gemini-3-flash #38 1437.0205766394988

只展示 Top 10 内出现的分类与变体。同一分类下若有多个变体(thinking / search 等),只显示排名最靠前的。 LMArena 是 Elo 分,人类盲测两两投票算出来—— 「人类觉得好」≠「客观最强」,但反映真实使用体验。

SuperCLUE · 中文能力测评

未收录:SuperCLUE 5 月榜未收录 Gemini 3 Flash Preview。

API 价格与国内可用性

来源 openrouter.ai · 抓取于 2026-07-22
输入价格 $0.50 / 百万 token
输出价格 $3.00 / 百万 token
上下文窗口 1049K tokens
国内可用性 不稳定
最近核验 2026-07-18T04:14:04.167577+08:00
同档对手价格
模型 输入 输出 国内
Gemini 3.1 Flash Image (Nano Banana 2) · Google $0.50 $3.00 需代理
Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview) · $0.50 $3.00
Nous: Hermes 4 405B · $1.00 $3.00
Qwen: Qwen3 235B A22B Thinking 2507 · $0.30 $3.00

Vectara HHEM · 幻觉率实测

vectara/hallucination-leaderboard · 2026-07-02T04:24:22.584572+08:00
幻觉率(Hallucination Rate) 13.5% (越低越好 · 全榜第 85 / 105)
事实一致率 86.5%
答题率(Answer Rate) 99.8%

Vectara HHEM-2.3 是开源的事实一致性评估器。让模型对 7700+ 篇文档(新闻/科技/科学/医疗/法律/体育/商业/教育)做摘要, 温度=0,HHEM 评估摘要是否「捏造原文里没说的内容」。 幻觉率不等于"模型质量"——它只衡量摘要任务的事实一致性,做题强的旗舰模型反而经常更爱"加戏"。 但对 RAG、客服、医疗法律这种「不能瞎说」的场景,这是目前最有参考价值的指标之一。

什么时候选它 / 别选它

适合场景
  • 实时对话和流式输出——182 token/s 的响应速度体验极佳
  • 大批量低成本任务——输出价只有 Pro 的 25%
  • 需要超长上下文的速度型任务——1M 窗口 + 182 token/s 的组合独一无二
不适合场景
  • 高智能推理——Intelligence 46.43,比 Pro Preview 低 10.75 分
  • 复杂代码任务——Coding Index 42.62,在代码榜里排不到前面
  • 严肃商业场景——Preview 标签意味着 API 行为可能变动

不选它的话,看看这些

Gemini 3 Flash Preview 常被拿来比的对