DeepSeek涨价+阿里开源2.4万亿旗舰+GLM-5.3跃升:中国大模型8月为何集体"变阵"?

约 20 分钟阅读 · MACCOME · 最后更新:2026 年 8 月 17 日

导语:8 月 12 日到 17 日的五天里,中国大模型圈接连做了三件互相矛盾又互相呼应的事:DeepSeek 宣布 API 涨价最高超 1100%,阿里同步把从未开源过的 Qwen-Max 级旗舰模型 2.4 万亿参数权重放出来,智谱则用同一个基座模型、纯靠后训练把编程测试成绩拉高数倍。本文按时间线、价目表、许可证条款和基准测试,拆清「从卷价格转向卷定价权」这条主线,并给出账单测算与选型步骤。V4 正式版与峰谷计费背景见DeepSeek V4 GA 迁移指南;Qwen 发布窗口见Qwen3.8-Max 发布解读

warning

一句话结论:三家公司、三种打法,共同指向同一个信号——国产大模型正在从「卷价格」转向「卷定价权」。文中价格、许可证与跑分以公开公告交叉核对;芯片服务、Cursor 漏洞与出口管制传闻已单独标为未经独立验证

六大痛点:刷到「涨 1100%」之后,团队真正要算清的账

标题数字很响,但对正在跑 Agent、评估开源权重和拆 API 账单的团队来说,真正卡住决策的是这些盲区:

  1. 涨价口径对不上:「涨 11 倍」「涨超 1100%」「涨 350%」都对,但分别对应缓存命中输入、输出、缓存未命中输入,混用会把预算算歪。
  2. 高峰时段被忽略:北京时间 9–12 点、14–18 点是新高峰窗;同一工作负载错峰与否,账单可以差一倍。
  3. 「官方最便宜」第一次被打破:高峰时段 DeepSeek 官方价已反超部分第三方转售(如 GMI Cloud、Novita 当前报价仍低于官方高峰价)。
  4. 开源不等于 Apache 2.0:Qwen3.8-Max 用自定义许可证,年营收超 5000 万美元的 MaaS / AI 工作助手必须另谈授权。
  5. 地域禁令谣言跑得比许可证原文快:官方文本并无美欧英韩下载禁令,误信会误判合规。
  6. 把厂商自测当生产切换依据:GLM-5.3 的 Terminal-Bench 跃升尚无独立第三方复测,且仍落后 GPT-5.6 Sol 与 Claude Fable 5。

发生了什么:一张时间线看懂这两周

把镜头拉远一点:7 月 30 日 OpenAI 已经把最便宜档的 GPT-5.6 Luna 降价 80%,8 月 6–7 日又把 Luna 设为免费用户默认模型并开放无限文本对话——也就是说,中国厂商在涨价和开源上做加法的同一时间,美国厂商正在免费和降价上做加法。这不是巧合,而是同一场定价博弈的两个侧面。Luna 调价细节见GPT-5.6 降价拆解

日期事件
7月16日月之暗面 Kimi K3(2.8 万亿参数)开源,此前已引发美方安全关注
8月2日–3日阿里 Qwen3.8-Max 先预告、后上线云端 API
8月10日Meta 发布开源模型 Muse Glimmer(300 亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重「即将开源」
8月12日阿里正式在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6
8月13日DeepSeek-V4-Pro 正式版上线,同步公告 8 月 17 日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash
8月14日智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430 亿参数基座
8月17日 0点(北京时间)DeepSeek 新定价正式生效

核心数据一览:DeepSeek 涨价明细、Qwen 规格、GLM 基准

DeepSeek 涨价明细(8月17日0点起,北京时间 9–12 点、14–18 点为高峰时段)

单位:每百万 tokens。缓存命中场景涨幅最大(最高约 12 倍 / 1100%+),但绝对金额仍很小;对重度调用者影响更大的其实是输出价格(350%)和缓存未命中输入价格。

计费项(每百万 tokens)涨价前空闲时段(新)高峰时段(新)涨幅(高峰)
V4-Flash 缓存命中输入¥0.02¥0.05¥0.10约 400%
V4-Flash 缓存未命中输入¥1.0¥1.5¥3.0200%
V4-Flash 输出¥2.0¥4.5¥9.0350%
V4-Pro 缓存命中输入¥0.025¥0.15¥0.30约 1100%
V4-Pro 缓存未命中输入¥3.0¥4.5¥9.0200%
V4-Pro 输出¥6.0¥13.5¥27.0350%
info

数据来源:DeepSeek 官方公告,经华尔街见闻、IT之家、V2EX 等多方交叉核对。headline「1100%」只对应高峰时段缓存命中输入;输出涨 350%,才是多数真实账单的主项。

Qwen3.8-2.4T-A95B(Qwen3.8-Max 开源权重)关键规格

这是阿里历史上首次把 Max 级(旗舰)模型开源,此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API。

项目数据
参数规模2.4 万亿总参数,950 亿激活参数(MoE,512 个专家,10 路由 + 1 共享)
上下文窗口开源权重原生 26.2 万 tokens,可扩展至约 101 万;云端 Max 版默认 100 万 tokens
发布节奏8 月 2 日预告 → 8 月 3 日 API 上线 → 8 月 12 日开源权重
API 定价(国际站)输入 $2 / M tokens,输出 $6 / M tokens
许可证非 Apache 2.0,自定义「Qwen3.8-Max License」
意义阿里历史上首次把 Max 级旗舰模型开源

GLM-5.3 vs GLM-5.2:同基座,纯靠后训练

以上为智谱官方自测数据,尚无独立第三方复测结果。GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),并非全面登顶,而是「开源模型第一梯队」。

基准测试GLM-5.2GLM-5.3变化
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam(CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0

深度拆解:三种打法,三种逻辑

1. DeepSeek:从「贴地价」到「分时定价」,本质是算力紧张的显性化

DeepSeek 这次涨价最容易被误读为「跟涨」,但细看结构会发现它更像一次「算力账单透明化」。此前 DeepSeek 长期采用不分时段的统一低价,本质上是用低价换取用户规模,再靠缓存命中率和错峰调度摊薄成本。但当调用量指数级增长、GPU 产能跟不上时,这套模式撑不住了——涨价公告里「鼓励更灵活的工作负载调度」这句话,翻译过来就是「我们的算力已经不够用了,请你自己错峰」。

值得注意的细节:涨价后 DeepSeek 官方 API 的价格,在高峰时段已经反超部分第三方转售平台(如 GMI Cloud、Novita 等目前报价仍低于 DeepSeek 官方高峰价)。这意味着「官方价格最便宜」这个曾经支撑 DeepSeek 护城河的假设,第一次被打破。

2. 阿里:开源权重,圈住生态;自定义许可证,圈住收入

Qwen3.8-Max 的开源不是简单的「慈善」。阿里同时做了两件事:把 2.4 万亿参数的权重公开下载,同时给这个权重配了一份不同于以往 Apache 2.0 的自定义许可证——年营收超 5000 万美元的「模型即服务」或「AI 工作助手」业务,必须单独找阿里谈商业授权;月活超 1 亿或月收入超 2000 万美元的产品,必须在界面上显著展示模型名称。

这套组合拳的逻辑是:用开源换开发者生态和口碑(尤其是海外开发者,缓解「国产模型上不了台面」的印象),但在真正能产生现金流的大客户身上,继续保留议价权。这也是为什么它和 Meta 的 Muse Glimmer(完全 Apache 2.0,无附加条款)在「开源程度」上其实不是一个量级。Kimi K3 的开放权重门槛对照见Kimi K3 全面开源解读

需要澄清一个流传较广的谣言:网上一度传阿里的许可证禁止美国、欧盟、英国、韩国用户下载,这是不实信息,官方许可证原文中并无任何地域限制条款——这类谣言的传播速度往往比读一遍原始许可证文本更快,值得对信息源保持警惕。

3. 智谱 GLM-5.3:不换基座,只换「后训练配方」,说明规模化训练已不是唯一杠杆

GLM-5.3 最值得关注的不是分数本身,而是「怎么拿到这个分数」——基座模型和 GLM-5.2 完全相同(7430 亿参数),没有重新预训练,仅靠扩大强化学习环境规模做后训练,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍提升。这印证了行业内近半年逐渐清晰的一个趋势:当预训练的 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新的性能杠杆,而这个杠杆的门槛显著低于重新训练一个千亿级基座模型,意味着更多中小厂商也有机会靠「精装修」追上头部模型。

横向对比:涨价之后,DeepSeek 还是「最便宜的旗舰」吗?

换算汇率按约 ¥7.15 / $1 估算,仅供参考,实际以官方公告为准。可以看到:涨价后 DeepSeek V4-Pro 空闲时段价格仍明显低于 Claude Opus 5,但已经不再是「全场最低」——阿里国际站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的空闲价更便宜,说明「国产 = 最便宜」的等式正在瓦解,价格竞争进入分层阶段。

模型输入价格(每百万 tokens)输出价格(每百万 tokens)开源程度
DeepSeek V4-Pro(高峰)¥9.0(约 $1.26)¥27.0(约 $3.78)权重未开源
DeepSeek V4-Pro(空闲)¥4.5(约 $0.63)¥13.5(约 $1.89)权重未开源
Qwen3.8-Max(国际站)$2$6开源(自定义许可证)
OpenAI GPT-5.6 Luna$0.20$1.20闭源
Claude Opus 5(据阿里披露的倍数关系推算)约 $5约 $25闭源

争议点与需要注意的细节

  • 涨价幅度的口径混乱:不同媒体分别报道「涨 11 倍」「涨超 1100%」「涨 350%」,这些说法都对,但对应的是不同计费维度(缓存命中输入 vs 输出 vs 缓存未命中输入),阅读时需要看清具体是哪一项。
  • 阿里「震悟 M890 国产芯片」服务的说法:多家中文财经媒体报道称 Qwen3.8-Max 部分推理服务跑在阿里自研的震悟 M890 芯片和「盘古 AL128」超节点上,但这一细节目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准测试确认,建议标注为未经独立验证的信息。
  • GLM-5.3「发现 Cursor 严重漏洞」的说法:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开披露,真实性和影响范围有待第三方安全机构确认,属于厂商单方面披露
  • 中国商务部可能酝酿反制出口管制:部分报道提及中国官方可能针对 AI / 半导体技术酝酿反制性出口管制措施,这一说法目前未见官方正式确认,属于媒体推测 / 传闻性质,仅供背景参考。

影响与背景:这不是孤立事件,而是一场「两线战争」

把这几件事放进更大的叙事里看:过去一个月,中国头部模型厂商呈现出「一周三更」的密集发布节奏——DeepSeek、阿里、智谱之外,还有月之暗面 Kimi K3(7 月 16 日,2.8 万亿参数开源)、MiniMax H3 等轮番登场。国内财经媒体普遍将这一现象解读为「中国开源模型密集发布,倒逼全球 AI 行业重新定价」。

与此同时,美国厂商走的是另一条路径:OpenAI 7 月 30 日大幅降价(Luna 降 80%),8 月 6–7 日把降价后的 Luna 设为免费用户默认模型并开放无限文本对话;谷歌 8 月 13 日发布价格减半的 Gemini 3.7 Flash。也就是说,中国厂商在「开源旗舰 + 梯度涨价」,美国厂商在「消费端免费 + 降价防守」——两条路径同时发生,共同把 2026 年 8 月变成了大模型行业定价逻辑重构的一个关键节点。

另一层背景是地缘政治:月之暗面 Kimi K3 的开源此前已引发美方安全审查关注,阿里选择在这个窗口把 2.4 万亿参数的旗舰模型开源,被部分分析解读为「在潜在监管收紧前,抢先巩固国产模型的国际影响力和技术对等叙事」。这一判断带有一定推测性质,但确实是理解这波开源潮时机选择时不可忽略的背景。

六步账单与选型 Runbook:涨价生效后怎么落地

不要被 headline 百分比带着走。按下面六步,把「会不会更贵」落成可执行的账单与路由决策:

  1. 先标高峰窗:把现有调用按北京时间切成 9–12、14–18 与其余空闲段,统计各段 token 占比。
  2. 再拆计费项:分别统计缓存命中输入、缓存未命中输入、输出;headline 1100% 只打在第一项,输出 350% 才是多数账单主项。
  3. 对照官方 vs 转售 vs 替代模型:高峰走官方 DeepSeek 不一定最便宜;同步核 Qwen3.8-Max 国际站($2 / $6)和 GPT-5.6 Luna($0.20 / $1.20)。
  4. 读许可证原文,不要读转发:个人与内部使用基本不受影响;MaaS / AI 工作助手且过去 12 个月该业务收入超 5000 万美元,才需另谈商业授权。
  5. GLM-5.3 先当「开源第一梯队」而不是生产切换令:官方自测尚未第三方复测,Terminal-Bench 3.0 仍落后 Sol / Fable 5;可小流量对照,不要一次性切全量。
  6. 把错峰批处理与开源权重推理放到常驻节点:笔记本合盖会打断夜间空闲窗;需要 7×24 调度时,用专用 macOS 节点跑批处理、本地权重与审计日志。
python
# DeepSeek V4-Pro 粗算:只演示「高峰 vs 空闲」对输出项的影响
# 价格来自 2026-08-17 生效价目(人民币 / 百万 tokens)
PEAK_OUT, OFF_OUT = 27.0, 13.5

def monthly_output_bill(out_tokens_m, peak_share):
    peak = out_tokens_m * peak_share * PEAK_OUT
    off = out_tokens_m * (1 - peak_share) * OFF_OUT
    return round(peak + off, 2)

print(monthly_output_bill(10, 0.8))  # 高峰占 80% → ¥243.0
print(monthly_output_bill(10, 0.2))  # 高峰占 20% → ¥162.0

三组值得引用的硬数据

  • 约 1100%:V4-Pro 高峰时段缓存命中输入,从 ¥0.025 涨到 ¥0.30 / 百万 tokens;绝对金额仍小,headline 最大。
  • 2.4T / 95B:Qwen3.8-2.4T-A95B 总参数 2.4 万亿、激活 950 亿;开源权重原生 26.2 万 tokens,可扩至约 101 万。
  • 4.6% → 28.3%:GLM-5.3 在同一 7430 亿基座上,Terminal-Bench 3.0 接近 6 倍提升,仍落后 Sol 34.6% 与 Fable 5 的 33.7%。

收束:定价权分层了,常驻算力还是要自己握着

8 月这五天把三件事叠在同一张价目表上:DeepSeek 用峰谷价把算力短缺写进账单,阿里用开源权重换生态、用自定义许可证留议价权,智谱用后训练证明「精装修」也能追上第一梯队。对正在跑 Agent 和开源权重的团队,常见三类结构性瓶颈依旧在:

  • 笔记本睡眠打断错峰窗:合盖等于放弃北京时间夜间空闲价,headline 涨幅会原样落到账单上;
  • 共享开发机权限过宽:API Key、权重文件和批处理队列混在同一台会睡眠的电脑上,既算不清峰谷,也难做许可证审计;
  • 缺一台 7×24 的调度中枢:错峰批处理、本地开源权重推理和调用日志,需要专用节点,而不是临时云函数。

若你要把错峰调度、开源权重推理和 API 账单审计放到稳定、可隔离的生产拓扑,MACCOME 的 Mac 云主机提供真实 macOS、SSH 交接与网络边界可控的环境,适合 7×24 常驻。公开方案见Mac mini 云租用价格

数据来源:DeepSeek 官方涨价公告,经华尔街见闻、IT之家、AIGC 工具导航、V2EX 社区讨论交叉核对;阿里 Qwen 官方模型仓库(Hugging Face / ModelScope)及南华早报(SCMP)关于许可证条款的报道;智谱(Z.ai)GLM-5.3 官方技术页面及 VentureBeat、StableLearn 相关报道;Meta AI Research 官方博客及 VentureBeat 关于 Muse Glimmer 的报道;第一财经、搜狐财经等关于中国大模型密集发布节奏的综合报道。以上数据截至发稿前公开信息整理,涉及价格、许可证条款、基准测试分数等内容建议发布前再次核实最新官方公告;部分细节(如芯片服务、安全漏洞发现、出口管制传闻)已在正文中标注为未经独立验证信息。

常见问题

DeepSeek 这次涨价之后,是不是意味着以后用起来更贵了?

要分场景看。如果你的调用大多落在空闲时段(非北京时间 9–12 点、14–18 点),且是缓存命中率较高的重度用户,实际涨幅会明显低于表面的「350%」「1100%」这类 headline 数字(有分析测算重度用户实际账单涨幅约为 1.8 倍左右);但如果集中在高峰时段调用、且缓存命中率低,涨幅会接近甚至达到 headline 数字。

阿里开源的 Qwen3.8-Max,个人开发者能免费商用吗?

个人开发者和内部使用基本不受影响。但如果你的业务是「模型即服务」或「AI 工作助手」类产品,且过去 12 个月内该业务累计收入超过 5000 万美元,需要单独向阿里申请商业授权;如果产品月活超 1 亿或月收入超 2000 万美元,需要在界面上显著标注模型名称。

GLM-5.3 和 GLM-5.2 是同一个模型吗?为什么突然变强这么多?

底层基座模型确实完全相同(7430 亿参数),智谱没有重新训练。分数大幅提升的原因是后训练阶段大幅扩大了强化学习环境的规模,这说明当前阶段「后训练规模化」本身就是一个独立、有效的性能杠杆,不一定需要重新预训练一个更大的基座。

网传阿里的 Qwen3.8-Max 许可证禁止美国、欧盟用户下载,是真的吗?

不是真的。这是网络上流传的不实信息,官方许可证原文中没有任何地域限制条款,主要限制是针对超过特定营收规模的商业化服务,与用户所在地区无关。

Meta 这次开源 Muse Glimmer,是不是意味着 Llama 时代的开源精神又回来了?

目前还只能算「部分回归」。Muse Glimmer 本身只是一个 300 亿参数的蒸馏小模型,Meta 真正的旗舰闭源模型 Muse Spark 1.2 尚未开源,扎克伯格只是「预告」未来会开放其权重。如果这一步真的落地,才称得上是美国厂商首次把旗舰级闭源模型转为开源,目前仍需持续关注后续进展。若你需要在常驻 Mac 上跑开源权重或错峰批处理,可查看MACCOME Mac 云租用方案