← 返回首页
A I · D A I L Y 2026 年 8 月 28 日 · 星期四

国产开源双子星同夜亮剑 · 英伟达收益分成踩反垄断刹车

今日看点:智谱阿里同晚开源 · 5000亿存储大单 · 500万亿Token · 百家AI网络防御联署
01

今日头条 · AI 大事记

AUG 28
MODEL OPEN SOURCE

智谱 GLM-5.3-Flash 与阿里 Qwen3.8-Flash 同晚开源,旗舰级推理成本打到海外 1/40

8 月 26 日晚,智谱正式以 MIT 协议开源 GLM-5.3-Flash(320B-A18B),确认其就是刷屏一周的匿名模型"牛来"(Ox Alpha);阿里同日开源 Qwen3.8-Flash-Next,作为下一代 Qwen4 架构首个公开权重预览版(176B 总参、每 token 仅激活 6B)。两个模型都把旗舰级多模态能力压到极低推理成本,国产算力(商汤大装置、昆仑芯)同步完成训练与适配。

REGULATORY RISK

英伟达紧急暂停 AI 云收益分成计划,内部担忧反垄断审查

据《华尔街日报》8 月 27 日报道,英伟达已于上周暂停 7 月推出的 AI 云服务商融资分成计划部分协议。该计划以信用支持换云收入分成、客户卖不掉算力还可由英伟达租回。暂停原因是内部员工对反垄断审查和"芯片厂商干预客户经营"边界的担忧。摩根士丹利同日首次覆盖英伟达信用评级给中性,警告其正把资产负债表变成"资产负债表即服务"。

CHIP · SK / NVIDIA

SK 集团与英伟达签超 5000 亿美元合作

锁定 HBM4 供应与联合开发,SK 电讯建 2GW Vera Rubin AI 数据中心,2027 年上线;SK 海力士同日在印第安纳动工美国首个 HBM 封装基地。

INFRA · 中国算力

中国日均 Token 调用量突破 500 万亿

较 2024 年初增长千倍,部分国产模型调用量暴涨 6800%;"十五五"算力网新增直接投资 4 万亿元,智算规模达 2185 EFLOPS。

SECURITY · OPEN LETTER

OpenAI 牵头百家机构呼吁 AI 网络防御

Anthropic、谷歌、微软、AWS、甲骨文及 CrowdStrike、Okta 等联署,引用智能体沙箱逃逸事件;欧盟 CRA 9 月 11 日生效。

MODEL · ALIBABA

Qwen3.8-Flash 训练成本降 90%

125B 主模型 + 51B N-gram Embedding,采用 GDN+QSA 混合注意力新架构,原生 262K 上下文可扩展至 100 万,权重已上线 Hugging Face 与魔搭。

DEEP DIVE · 深度追踪

国产开源双子星同夜亮剑:
当旗舰模型开始按"白菜价"批发

智谱和阿里选在同一个晚上开源,不是巧合,而是中国大模型对"成本-能力"曲线的一次集体重定价
02

事件核心事实

1/40
GLM-5.3-Flash 价格约为 Claude Opus 4.8
6B
Qwen3.8-Flash 每 token 激活参数(总 176B)
90%
Qwen 新架构训练成本较上一代降幅
■ 智谱 GLM-5.3-Flash(320B-A18B)

匿名盲测一周后揭面,MIT 全量开源

  • 8 月 20 日起以 Ox Alpha 代号在 OpenRouter、OpenCode 匿名测试,首日登顶用量榜
  • 8 月 26 日晚智谱正式认领并 MIT 协议开源权重,GLM-5 系列首个原生多模态模型
  • 总参数 320B,每 token 激活 18B,支持 100 万 token 上下文及图像/视频输入
  • 由商汤大装置等国产算力集群训练,昆仑芯开源当日完成适配
■ 阿里 Qwen3.8-Flash-Next(176B 总参 / 6B 激活)

Qwen4 架构首次公开权重,不是普通迭代

  • 主模型 125B + 51B N-gram Embedding,每 token 仅激活 6B,原生 262K 可扩展 100 万上下文
  • 采用 GDN + QSA 混合注意力新架构,是下一代 Qwen4 的实验预览版
  • 训练成本较上一代下降近 90%,推理定价输入 1 元 / 输出 3 元每百万 token
  • 权重在 Hugging Face、魔搭社区同步开放,已上线 Ollama 并进入 llama.cpp 适配

1同晚开源是一次有预谋的"定价围剿"

智谱和阿里选在同一个晚上发版,不是巧合。两家都用 Flash 命名、都主打"旗舰能力 + 极低价格"、都用 MIT 或宽松许可,目标明确:在 DeepSeek V4-Pro 8 月 17 日大幅涨价后,抢占"便宜大碗旗舰"的生态位。对中小开发者而言,现在的选型逻辑已经从"用不用国产模型"变成"用哪个国产模型"。

2"匿名盲测"正在成为国产模型的标准营销武器

智谱已经是第二次用匿名模型先免费跑一周赚流量(上次是 GLM-5.2)。Ox Alpha 在 OpenRouter 登顶的故事比任何官方 benchmark 都有传播力——它让海外开发者在不知道厂商的情况下用脚投票,再揭晓"中国造"。这种打法对品牌信任的建立效率,远超传统发布会。

3成本曲线的真实含义:推理正在变成公用事业

Qwen 把训练成本降 90%、每 token 只激活 6B,智谱把价格压到 Claude 的 1/40——这不是"性价比优化",而是推理成本的代际坍塌。当旗舰级多模态推理便宜到可以不计成本地嵌入每一个工作流,Agent 经济的单位经济学才真正成立。但反过来说,模型层的利润空间也在被同步压扁,纯模型公司的商业模式需要重新论证。

4国产算力闭环是这轮开源最被低估的信号

智谱 GLM-5.3-Flash 跑在商汤大装置上、昆仑芯开源当日适配——这意味着从训练到推理的国产芯片栈已经能支撑 320B 级 MoE 多模态模型的 day-0 交付。在英伟达收益分成计划因反垄断被叫停、HBM 供应链向美国本土转移的背景下,国产算力与国产模型的深度绑定正在从"备选方案"变成"主路径"。