Gemini 3 系列怎么选?3.6 Flash / 3.5 Flash / 3.1 Pro 实测对比
Google Gemini 3 家族的特点是「快」和「长」——旗舰档里速度前列、上下文 1M 起步。 3.6 Flash 是最新旗舰(主打编程和 Agent 工作流),3.5 Flash 是速度之王(156 tokens/s,Intelligence 50 全球第 6),3.5 Flash Lite 是轻量子代理($0.3/$2.5 全系最低),3.1 Pro 是综合旗舰。 但国内可用性标注「不稳定」,这是选型时必须考虑的因素。
一句话结论
要编程和 Agent 工作流上 3.6 Flash。 7 月 21 日发布的新旗舰,官方定位编程/Agent/Web 开发,$1.5/$7.5 比 3.5 Flash 便宜 17%。AA/Arena 评测数据待收录。
要速度上 3.5 Flash。 156 tokens/s(旗舰档前列)、$1.5/$9、Intelligence 50 全球第 6——速度比 3.1 Pro(117 t/s)快 33%,能力反高 4 分。
跑 Agent 子任务上 3.5 Flash Lite。 $0.3/$2.5 全系最低,专为多 Agent 架构中的子代理设计,跑量不心疼。
要综合能力上 3.1 Pro Preview。 Intelligence 46(全球第 8)、$2/$12——能力比 Claude Opus 4.7(54)略低,但价格只有一半。
国内可用性是最大隐患。 Google 服务在中国大陆不稳定,生产项目必须准备 fallback。
全系参数对照
| 型号 | Intelligence | 速度 t/s | 上下文 | 输出价 |
|---|---|---|---|---|
Gemini 3.6 Flash 编程/Agent | 待收录 | 待收录 | NaNK | $7.5 |
Gemini 3.5 Flash 速度 | 50 | 165 | 1M | $9 |
Gemini 3.5 Flash Lite 子代理 | 待收录 | 待收录 | NaNK | $2.5 |
Gemini 3.1 Pro 旗舰 | 46 | 125 | 1M | $12 |
Gemini 3 Flash 轻量 | — | — | 1M | $3 |
数据来源:Artificial Analysis(2026-07-21)。
Gemini 3.1 Pro:被低估的旗舰
Gemini 3.1 Pro Preview Intelligence 46,全球第 8,介于 Gemini 3.5 Flash(50)和 Qwen3.7 Max(46)之间。 Coding 数据未单独公布(AA 显示 null),速度 117 tokens/s 比 Claude Opus 4.7(55)快 2.6 倍。
$2/$12 的定价是最大惊喜。输出 $12/M 比 Claude Opus 4.7($25)便宜 52%,比 GPT-5.5($30)便宜 60%。 这是「旗舰能力、中端价格」的罕见组合。
3.1 Pro 适合什么:
- 长文档分析——1M 上下文 + 速度快,1000 页 PDF 几分钟读完
- 代码任务——编程能力全球顶尖,前端开发尤其强
- 多模态场景——Gemini 原生支持图片、视频、音频理解
- 需要「快 + 强」的组合——117 t/s 的速度在旗舰里前列
3.1 Pro 的短板: Agent 能力比 GPT-5.5 和 Claude Opus 4.7 弱——复杂 Agent 编排不是 Gemini 的强项。 国内可用性标注「不稳定」——Google 服务在中国大陆时好时坏,生产项目必须准备 fallback。
Gemini 3.5 Flash:速度之王
3.5 Flash 可能是 2026 年最被低估的模型。Intelligence 50(全球第 6)、速度 156 tokens/s(旗舰档前列)、$1.5/$9、1M 上下文。 这个「能力/速度/价格」组合在旗舰里很罕见。
156 t/s 是什么概念?写 1000 字(约 750 token)只要 3.9 秒。 对比 Claude Opus 4.7(55 t/s,13.6 秒)、GPT-5.5(69 t/s,10.9 秒)、Qwen3.7 Max(200 t/s,3.8 秒)、GLM-5.2(183 t/s,3.5 秒)。 国产的 Qwen3.7 Max 和 GLM-5.2 比它更快,而且 Qwen 现在更便宜($3.75 vs $9,便宜 58%)——3.5 Flash 的速度优势不再独占。
3.5 Flash 适合什么:
- 实时对话和客服——用户等 4 秒 vs 等 14 秒,体验天差地别
- 流式生成场景——直播字幕、实时翻译、IDE 补全
- 高并发 API——速度快意味着同样并发下延迟更低
- 长文档快速扫描——1M 上下文 + 156 t/s,整本书几分钟扫完
3.5 Flash 的边界: Intelligence 50 比 3.1 Pro(46)反而高 4 分,复杂推理场景不弱。 Coding 数据为 null(AA 改版后新模型暂无),但基于 Google 在代码上的历史表现,应该不差。 同样面临国内可用性问题。
Gemini 3.6 Flash:编程/Agent 新旗舰
7 月 21 日发布的新旗舰,官方定位编程、Agent 工作流和 Web/App 开发。 核心卖点:'更少多余编辑、更精炼输出'——说明代码生成质量做了针对性优化,不是简单堆参数。
$1.5/$7.5 的定价比 3.5 Flash($9/M 输出)便宜 17%,1M 上下文,支持文本/图片/音频/视频/文件全模态输入。 AA/Arena 评测数据待收录(发布仅 1 天),但基于 Google 在代码上的历史表现和官方定位,编程能力应该不弱。
3.6 Flash 适合什么:
- 编程和代码生成——官方核心定位,'更少多余编辑'说明代码质量有针对性提升
- Agent 工作流——支持多步编排,适合自动化任务链
- Web/App 开发——官方明确提及的开发场景
- 多模态输入——图片/音频/视频/文件全吃,1M 上下文兜底
3.6 Flash 的不确定: 评测数据暂未收录,能力定位主要靠官方描述。如果 AA Intelligence 能达到 50+,$7.5/M 的输出价在旗舰档里性价比不错。 同样面临国内可用性问题。
Gemini 3.5 Flash Lite:Agent 子代理专用
3.5 Flash Lite 是 Gemini 家族最轻量的成员,定位是 Agent 工作流中的子代理——执行聚焦任务而非主导推理。 $0.3/$2.5 的定价是 Gemini 系列最低,1M 上下文,支持全模态输入。
什么意思?如果你在跑一个多 Agent 架构(比如一个主 Agent 负责规划,多个子 Agent 负责执行), 子 Agent 不需要最强推理能力,但需要跑量大、成本低。3.5 Flash Lite 就是干这个的。
3.5 Flash Lite 适合什么:
- Agent 子任务——官方定位'执行聚焦任务的子代理',多 Agent 架构里的执行层
- 大批量低成本调用——$0.3/M 输入是 Gemini 系列最低,跑量不心疼
- 多模态轻量处理——图片/音频/视频/文件全吃,但价格只有 3.5 Flash 的 1/5
3.5 Flash Lite 不适合: 复杂推理——轻量模型,不是用来做主推理的。独立对话场景——更像是工作流里的螺丝钉,不是对话主角。
Gemini 3 Flash:入门但竞争力弱
3 Flash 是 Gemini 家族的入门档:$0.5/$3、1M 上下文。 Intelligence 数据未在 AA 主榜 top 12 里公开,但基于 Google 的产品线定位,应该在 45-50 区间。
问题是:3.5 Flash($9/M、Intelligence 50、156 t/s)比 3 Flash 能力强得多,价格只贵 3 倍。 而 3 Flash 比 Gemini 2.5 Flash($2.5/M)还贵 20%,但 2.5 Flash 是上一代已经验证过的型号。
结论:3 Flash 的位置很尴尬。预算紧的选 Gemini 2.5 Flash($2.5/M),要能力的选 3.5 Flash($9/M)。3 Flash 不太有独立的存在价值。
国内可用性:最大隐患
Google 服务在中国大陆没有官方节点,访问依赖国际网络。 pricing 数据里标注「不稳定」——意味着延迟波动大、偶发连接失败、高峰期可能不可用。
实际影响:
- 网页端(Gemini App)时好时坏,需要科学上网
- API 调用延迟波动大,生产环境需要重试机制
- 没有国内 CDN,高峰期响应慢
- 付费方式受限——国内信用卡可能无法绑定
建议: 国内项目不要以 Gemini 为主力,可以作为「能力补充」或「fallback」。 如果必须用,准备国产替代(DeepSeek/Qwen)随时切换。 详见 国内怎么用 Claude / ChatGPT / Gemini。
Gemini vs 国际竞品
3.1 Pro vs Claude Opus 4.7(旗舰对决)
Intelligence 46 vs 54(7 月 AA),Opus 高 8 分——综合能力 Opus 更强。Coding 数据 AA 已不单独公布(新模型均为 null)。 速度 117 vs 55 t/s,Gemini 快 2.6 倍。价格 $12 vs $25/M,Gemini 便宜 52%。 唯一劣势是 Agent 能力偏弱和国内可用性。 如果不需要复杂 Agent 编排且能解决访问问题,3.1 Pro 用一半价格换接近的能力和近 3 倍速度。
3.5 Flash vs Qwen3.7 Max(速度之王对决)
速度 156 vs 200 t/s,Qwen 略快。Intelligence 50 vs 46,3.5 Flash 高 4 分。 价格 $9 vs $3.75/M,Qwen 便宜 58%。国内可用性 Qwen 完胜。 结论:国内场景选 Qwen3.7 Max(更便宜更快),国际场景或对综合能力更敏感选 3.5 Flash。
Gemini 3 vs GPT-5 系列
3.1 Pro($12/M)vs GPT-5.4($15/M):能力接近(46 vs 54.3),GPT-5.4 反而强 8 分但贵 25%。 3.5 Flash($9/M)vs GPT-5.4 mini($4.5/M):Flash 能力强得多(50 vs 40),但贵一倍。 Gemini 的核心优势是「速度 + 长上下文」,GPT 的核心优势是「生态 + Agent 能力」。
决策树
首选:Gemini 3.6 Flash($1.5/$7.5、1M 上下文、官方定位编程+Agent)
国内替代:DeepSeek V4 Pro(1M 上下文、$0.87/M)
速度优先:Gemini 3.5 Flash(156 t/s)
首选:Gemini 3.5 Flash(156 t/s、$9/M)
国内替代:Qwen3.7 Max(200 t/s、$3.75/M、国内稳定)
预算紧:Gemini 3.5 Flash Lite($0.3/$2.5)
首选:Gemini 3.5 Flash Lite($0.3/$2.5、1M 上下文、专为子代理设计)
国内替代:DeepSeek V4 Flash($0.09/$0.19)
需要更强能力:Gemini 3.6 Flash($7.5/M)
首选:Gemini 3.1 Pro(1M 上下文、117 t/s)
国内替代:DeepSeek V4 Pro(1M 上下文、$0.87/M)
速度优先:Gemini 3.5 Flash(156 t/s)
几个注意事项
- 国内可用性是硬伤。生产项目不要以 Gemini 为唯一主力,必须有 fallback。
- 3 Flash 竞争力弱。要么加钱上 3.5 Flash,要么省钱用 2.5 Flash。3 Flash 单独存在价值不高。
- Gemini 的多模态是独特优势。原生支持图片、视频、音频理解,这是 Claude/GPT 通过插件实现的方式没法比的。
- Google AI Studio 免费 tier 很慷慨。个人开发者可以先在 AI Studio 免费测试,确认适合再开 API。