2026-07-22 更新 · 价格监控

2026 年 7 月 LLM API 价格变动:Hy3 降 30%、GLM-5.2 六降、Gemini 3.6 Flash 上线

7 月价格继续剧烈波动(截至 7-22):Tencent Hy3 降价 30%(用量王也卷价格了);GLM-5.2 第六次降价 17%(上线 36 天累计降幅超 80%);Gemma-4-31b 大降 33-45%;DeepSeek V4 Flash 再降 4%;Gemini 3.6 Flash 和 3.5 Flash Lite 同日上线。 这篇告诉你哪些变动影响你的账单、哪些只是噪声

一句话总结

  • MiniMax M2.7 涨价 33%:输入 $0.18 → $0.24,输出 $0.72 → $0.96。这是本月最大幅度的涨价,从「性价比」档直接被拉到「中档」价位。跑量用户账单涨 1/3,值得考虑替代方案(DeepSeek V4 Flash、MiMo-V2.5)。
  • GLM-5.2 五次降价:输出价 26 天内从 $4.5 砍到 $1.10(累计 -76%)。国产旗舰里账单最优的选项。
  • DeepSeek V4 Flash 再次下调:输入 $0.089 → $0.077(-14%),输出 $0.18 → $0.154(-14%)。DeepSeek 连续 9 次微调全部向下,半年累计 -45%/-45%。
  • Kimi K2.6 涨价:输入 $0.55 → $0.66(+20%),输出 $3.20 → $3.41(+7%)。月之暗面在逆势涨价,原因不明——可能是用量上来后的成本调整。
  • Kimi K2.7 Code 微调:输入 $0.74 → $0.72,输出 $3.50 → $3.49,幅度很小,可以忽略。
  • 4 款新模型定价:Poolside Laguna XS 2.1($0.06/$0.12)、Sakana Fugu Ultra($5/$30)、Gemini 3.1 Flash Lite Image($0.25/$1.5)、NVIDIA Nemotron 3 Ultra($0.5/$2.2)。

DeepSeek V4 Flash:继续挤水分,但不值得为此切换

输入价从 $0.089 再降到 $0.077(-14%),输出从 $0.18 降到 $0.154(-14%)。如果你每月在 DeepSeek V4 Flash 上花 $1000,这次降价帮你省 $133。幅度依然不大,但累计很可观。

DeepSeek 已经连续 9 次微调价格,全部向下。从年初的 $0.14/$0.28 降到 输入 $0.0938 / 输出 $0.1876/M,半年累计降幅 45%/45%。这家公司的定价策略很明确:用量换价格,永远最便宜

当前价:输入 $0.0938 / 输出 $0.1876/M

MiniMax M2.7:涨价 33%,性价比优势收窄

输入价从 $0.18 涨到 $0.24(+33%),输出从 $0.72 涨到 $0.96(+33%)。这是本月幅度最大的涨价。 如果你每月用 MiniMax M2.7 处理 10M tokens 输入,账单从 $1.8 涨到 $2.4;输出 1M tokens 从 $0.72 涨到 $0.96。

涨价之前 M2.7 是「便宜 + 能打」的代表(和 MiMo-V2.5、DeepSeek V4 Flash 同档),涨价之后直接被拉到中档价位。对价格敏感的用户,建议评估替代方案:

  • DeepSeek V4 Flash:输入 $0.0938 / 输出 $0.1876/M,比 M2.7 便宜数倍,Intelligence 40(M2.7 此前在 38 左右),综合能力略强。
  • MiMo-V2.5:输入 $0.14 / 输出 $0.28/M,能力相当,是 M2.7 涨价后的直接替代。
  • MiniMax 的优势在中文长文本和营销文案,如果这是你的核心场景,涨价 33% 仍然值得。

当前价:输入 $0.25 / 输出 $1/M

Kimi K2.6:涨价 20%,性价比优势收窄

输入价从 $0.55 涨到 $0.66,涨幅 20%。输出从 $3.20 到 $3.41,涨幅 7%。如果你每月用 Kimi K2.6 处理 10M tokens 输入,账单从 $5.5 涨到 $6.6,多了 $1.1。

涨价之后,K2.6 的输入价已经和 Qwen3.7 Plus($0.32)不在一个档位了。K2.6 的优势在中文对话和长文档,但价格敏感的用户可能会转向更便宜的国产模型。输出价 $3.41 和 Claude Sonnet 5($10)还有距离,但差距在缩小。

当前价:输入 $0.684 / 输出 $3.42/M

新模型定价速览

模型 输入价 输出价 上线日期
Poolside Laguna XS 2.1 $0.06 $0.12 7 月 2 日
Gemini 3.1 Flash Lite Image $0.25 $1.50 7 月 1 日
NVIDIA Nemotron 3 Ultra $0.50 $2.20 6 月 4 日
Sakana Fugu Ultra $5.00 $30.00 6 月 24 日

Laguna XS 2.1 的定价直接对标 DeepSeek V4 Flash,但专注代码场景。Fugu Ultra 是日本 Sakana AI 的旗舰,$5/$30 的定价和 Opus 同档,但暂无第三方评测。Nemotron 3 Ultra 是 NVIDIA 开源 MoE,$0.5/$2.2 性价比较高。Gemini 3.1 Flash Lite Image 是 Google 最便宜的图像生成模型。

7 月 5 日补充:GLM-5.2 三次降价

7 月 5 日再次复核,智谱 GLM-5.2 又降了一轮:输入 输入 $0.784 / 输出 $2.464/M(原 $0.93,-17%),输出降到 $2.42(原 $3.0,-19%)。这是 GLM-5.2 自 6 月 16 日上线以来的第三次降价,一个月内输出价从 $4.5 砍到 $2.42,累计降幅超过 46%。

智谱这波降价很激进,直接把 GLM-5.2 拉到了 DeepSeek V4 Flash 的价格区间(V4 Flash 输出 $0.18,但 GLM-5.2 是旗舰定位)。如果你在用 GLM-5.2 做中文长文本、agent 调用,账单会明显下来一截。Nemotron 3 Super 同期也微调了输入价($0.085→$0.08),属于噪声级别。

注:智谱连续降价通常意味着竞品压力(DeepSeek、Qwen 都在低价区间)或为冲市场份额。短期对用户是好事,长期要看模型能力能否跟住。

7 月 9 日补充:GLM-5.2 第四次降价,输出砍到 $1.32

7 月 9 日复核,智谱 GLM-5.2 又降了一轮,这次幅度最大:输入 输入 $0.784 / 输出 $2.464/M(原 $0.91,-54%),输出降到 $1.32(原 $2.42,-45%)。这是 GLM-5.2 自 6 月 16 日上线以来的第四次降价,23 天内输出价从 $4.5 砍到 $1.32,累计降幅超过 71%。

这个价位已经比 Claude Sonnet 5(输出 $10)便宜近 8 倍,比同代国产旗舰 Kimi K2.6(输出 $3.41)便宜 60%。GLM-5.2 在 AA Intelligence 榜上排第 5(51 分,国产第一),现在它的性价比已经拉开第二梯队一大截。如果你在做中文长文本、agent 调用、需要 1M 上下文,GLM-5.2 现在是账单层面的最优解之一。

要注意 OpenRouter 价格含约 15% 加价,智谱开放平台直连价更低。但对绝大多数通过 OR 调用的开发者,这个价就是实付价。

注:23 天四降的节奏很反常。要么是智谱在抢 DeepSeek V4 / Qwen3.7 的存量市场,要么是算力成本在快速下降。无论如何,现在用 GLM-5.2 的窗口期很划算,但别把架构绑死在单一模型上——价格战随时可能反向。

7 月 12 日补充:GLM-5.2 第五次降价、DeepSeek V4 Flash 再降

7 月 12 日复核,智谱 GLM-5.2 又降了:输入 $0.35(原 $0.42,-17%),输出 $1.10(原 $1.32,-17%)。这是 GLM-5.2 上线 26 天以来的第五次降价,输出价从 $4.5 砍到 $1.10,累计降幅 76%。

现在 GLM-5.2 的性价比已经不只是"国产最便宜旗舰",而是直接威胁 DeepSeek V4 Flash 的低价区定位——后者 输入 $0.0938 / 输出 $0.1876/M 仍然便宜数倍,但 GLM-5.2 Intelligence 51(国产第一)和 V4 Flash 的 40 之间差距明显。如果你在做中文 agent、长文档、需要旗舰级能力,GLM-5.2 现在的价格已经低到值得认真切换。

DeepSeek V4 Flash 同日再降一轮:输入 $0.077(原 $0.084,-8%),输出 $0.154(原 $0.168,-8%)。连续 9 次微调全部向下,半年累计降幅超过 45%。如果你每月在 V4 Flash 上花 $1000,这次帮你省 $56。

注:GLM-5.2 的降价节奏已经进入"每周一次"的常态化。智谱很可能在用价格战锁住存量用户、抢 DeepSeek / Qwen 的增量。短期对用户是好事,但长期要看模型能力能否持续跟住——如果 GLM-5.2 的 Intelligence 排名下次刷新下滑,价格优势也救不了。

7 月 13 日补充:GLM-5.2 涨价 20%、Llama 4 Maverick 涨价 33%

7 月 13 日复核,价格风向变了——这次是涨价。智谱 GLM-5.2 刚降完又涨回:输入 $0.42(原 $0.35,+20%),输出 $1.32(原 $1.10,+20%)。这是 GLM-5.2 上线以来的首次涨价,距上次降价仅隔 1 天。

同一日,Meta Llama 4 Maverick 也涨价:输入 $0.20(原 $0.15,+33%),输出 $0.80(原 $0.60,+33%)。Llama 4 Maverick 是开源模型里用量最大的之一,这次涨价直接影响跑量用户的账单。

GLM-5.2 这波涨价很反常——之前 26 天五降,累计降幅 76%,现在一天涨回 20%。可能的解释:智谱发现降价没带来预期的增量用户,或者成本端(算力、带宽)在涨。对用户来说,GLM-5.2 的输出价 $1.32 仍然比 Claude Sonnet 5($10)便宜近 8 倍,但性价比优势已经从"碾压"收窄到"显著"。

注:两个模型同日涨价,可能是 OpenRouter 在调整整体定价策略(之前降太多,现在回血),也可能是厂商端的成本压力传导。短期看,账单敏感的用户要重新评估 GLM-5.2 和 Llama 4 Maverick 的替代方案。

7 月 17 日补充:Kimi K3 上线 $15/M、K2.6 再涨 44%、GLM-5.2 继续涨

7 月 17 日复核,涨价趋势在加速。最大变化是 Kimi——新旗舰 K3 上线,输出价 $15/M,是 Kimi 家族目前最贵的模型。同时 K2.6 一个月内第二次涨价:输入 $0.66→$0.95(+44%),输出 $3.41→$4.00(+17%)。

GLM-5.2 继续涨:输入 $0.85→$0.91(+8%),输出 $2.66→$2.87(+8%)。GLM-5.2 的价格已经从 7-9 的谷底($0.42/$1.32)涨了一倍多,回到了接近上线时的水平。之前「比 Claude 便宜 8 倍」的窗口正在收窄。

Kimi K3 定价分析: $3/$15 对标 Claude Opus 4.8($3/$15)和 GPT-5.6 Sol 系列。AA Intelligence 57 全球第 3,能力配得上这个价。但输出价是 K2.6 的 3.75 倍,是 DeepSeek V4 Pro($0.87)的 17 倍。如果不需要极致能力,K2.6 或 V4 Pro 仍是更经济的选择。

注:7 月的涨价潮(Kimi K2.6 两次涨价、GLM-5.2 从谷底反弹、Llama 4 Maverick 涨 33%)可能反映的是算力成本上升或厂商结束价格战。用户如果账单敏感,建议关注 DeepSeek V4 Flash(仍在降)和 Qwen3.7 系列(相对稳定)作为备选。

7 月 21 日补充:K2.6 过山车降价、Qwen3.5-27b 暴涨 67%、Nemotron 砍价过半

7 月 21 日复核,价格风向又变了——Kimi K2.6 从涨转跌,Qwen3.5-27b 大幅涨价,NVIDIA Nemotron-3-Super 砍价过半。

Kimi K2.6 降价:输入 $0.95→$0.68(-28%),输出 $4.00→$3.42(-14%)。一个月内三变价:7-4 涨 20%、7-17 再涨 44%、7-21 跌回。现在 $0.68/$3.42 比 7-4 涨价前的 $0.55/$3.20 还贵,但比 7-17 的 $0.95/$4.00 便宜不少。月之暗面的定价策略像在试探市场底线——涨太多用户跑了,又降回来。

Kimi K2.7 Code 涨价:输入 $0.75→$0.82(+9%),输出 $3.50→$3.75(+7%)。幅度不大,但 K2.7 Code 本来就不便宜,再涨就更难和 DeepSeek V4 Pro($0.87/M 输出)竞争了。

Qwen3.5-27b 暴涨:输入 $0.20→$0.26(+30%),输出 $1.56→$2.60(+67%)。这是本月开源模型里涨幅最大的。27b 是 Qwen3.5 系列的中端,之前 $1.56 的输出价让它和 DeepSeek V4 Flash 同档,现在 $2.60 直接跳到了 GLM-5.2 的区间。如果你在用 Qwen3.5-27b 跑量,账单会涨 2/3,建议评估 Qwen3.5-Plus($0.26/$1.56,能力更强)或 DeepSeek V4 Flash(输入 $0.0938 / 输出 $0.1876/M,便宜数倍)。

NVIDIA Nemotron-3-Super 大降:输入 $0.21→$0.09(-57%),输出 $0.45→$0.40(-11%)。NVIDIA 在开源 MoE 模型上打价格战,$0.09 的输入价已经接近 DeepSeek V4 Flash 的水平。如果你需要开源模型做推理部署,Nemotron-3-Super 现在值得认真看。

GLM-5 输出降价:输出 $3.15→$2.55(-19%)。GLM-5 是智谱上一代旗舰,这次降价可能是给 GLM-5.2 让路。如果你还在用 GLM-5,账单会降一截。

Gemma-4-31b 涨近倍:输入 $0.12→$0.22(+83%),输出 $0.37→$0.55(+49%)。Google 小模型涨价,原因不明。Gemma-4-26b-a4b 同期微调(输入 $0.10→$0.07 降了,输出 $0.30→$0.34 涨了),两个变体方向相反,可能是 Google 在调整产品线定价。

新模型:美团 LongCat 2.0 上线,$0.30/$1.20,1M 上下文。定价对标 GLM-5.2 和 Qwen3.7 Plus,主打长上下文中文场景。Meta Muse Spark 1.1 上线,$1.25/$4.25,是 Muse Spark 的升级版。

7 月 22 日补充:Hy3 降 30%、GLM-5.2 六降、Gemma-4 大降、Gemini 3.6 Flash 上线

7 月 22 日复核,降价潮继续——Tencent Hy3 大幅降价,GLM-5.2 第六次降价,Gemma-4-31b 从涨转跌,DeepSeek V4 Flash 继续挤水分。同时 Google 同日发布两款新模型。

Tencent Hy3 降价 30%:输入 $0.20→$0.14(-30%),输出 $0.80→$0.58(-28%)。Hy3 是 OpenRouter 用量第一的模型(11.56T tokens/周),这次降价直接把输入价拉到 DeepSeek V4 Flash 的区间。用量王也卷价格了,对跑量用户是好消息。

GLM-5.2 第六次降价:输入 $0.94→$0.78(-17%),输出 $2.97→$2.46(-17%)。上线 36 天累计降价六次,输出价从 $4.5 砍到 $2.46,累计降幅超 80%。虽然比 7-9 的谷底 $1.32 还贵,但趋势明确——智谱还在往下压。

Gemma-4-31b 大降:输入 $0.22→$0.12(-45%),输出 $0.55→$0.37(-33%)。7-21 刚涨近倍,7-22 又降回去了——Google 在调整产品线定价,Gemma 系列价格波动很大。如果你在用 Gemma-4-31b,现在反而比涨价前还便宜。

DeepSeek V4 Flash 再降:输入 $0.10→$0.09(-4%),输出 $0.20→$0.19(-4%)。连续 10 次微调全部向下,半年累计降幅近 50%。

Qwen3-Next-80b 输出降 29%:输出 $1.10→$0.78(-29%)。Qwen 系列在持续优化定价。

Nemotron-3-Super 输出涨 12.5%:输出 $0.40→$0.45(+12.5%)。7-21 刚砍价 57%,7-22 输出端又涨回来了。NVIDIA 的定价策略不太稳定。

Gemini Flash Latest 输出降 17%:输出 $9.00→$7.50(-17%)。Google 在为 3.6 Flash 上线铺路,3.5 Flash 的价格也在下调。

新模型上线:Google 同日发布两款——Gemini 3.6 Flash($1.5/$7.5,编程/Agent 旗舰)和 Gemini 3.5 Flash Lite($0.3/$2.5,Agent 子代理专用)。Poolside Laguna S 2.1 也上线了($0.10/$0.20,代码模型)。

对你的影响

  • 追求国产最强能力的:Kimi K3 上线了,AA Intelligence 57 全球第 3,$3/$15/M 对标 Claude Opus 4.8。能力确实强,但输出价是 K2.6 的 4.4 倍。不差钱可以试。
  • 用 DeepSeek V4 Flash 的:不用动。价格继续往下降是好事,但幅度太小不值得为此改代码。
  • 用 Kimi K2.6 的:过山车终于往下了——$0.68/$3.42,比 7-17 的 $0.95/$4.00 便宜 28%/14%。但比月初的 $0.55/$3.20 还是贵。如果用量大,看看 DeepSeek V4 Pro($0.87/M 输出)或 GLM-5.2 能不能替代。
  • 用 GLM-5.2 的:价格稳定在 输入 $0.784 / 输出 $2.464/M,比 7-9 的谷底 $1.32 涨了一倍多,但仍然比 Claude Sonnet 5($10)便宜 3 倍多。
  • 用 Qwen3.5-27b 的:输出价暴涨 67% 到 $2.60,建议评估 Qwen3.5-Plus($0.26/$1.56,能力更强)或 DeepSeek V4 Flash(输入 $0.0938 / 输出 $0.1876/M,便宜数倍)。
  • 需要开源模型的:NVIDIA Nemotron-3-Super 输入砍到 $0.09,接近 DeepSeek V4 Flash 水平,值得认真看。
  • 需要长上下文的:美团 LongCat 2.0 上线 $0.30/$1.20,1M 上下文,定价对标 GLM-5.2。
  • 需要图像生成的:Gemini 3.1 Flash Lite Image 上线了,$0.25/$1.5 是当前最便宜的图像 API。
  • 跑 Agent 工作流的:Gemini 3.6 Flash 上线了,$1.5/$7.5 官方定位编程+Agent。3.5 Flash Lite($0.3/$2.5)专为子代理设计,跑量不心疼。
  • 用 Tencent Hy3 的:降价 30%,输入 $0.14 已经接近 DeepSeek V4 Flash 的水平。用量王更便宜了。
  • 用 Gemma-4-31b 的:7-21 涨近倍,7-22 又降回去了,现在反而比涨价前还便宜。Google 定价波动大,别急着锁长期合约。