← 返回首页
A I · D A I L Y 2026 年 8 月 7 日 · 星期四

DeepSeek 预告涨价 · 价格战拐点信号出现

今日看点:国产价格锚点松动 · HBM 卡住英伟达 · AMD 收购推理芯片
01

今日头条 · AI 大事记

AUGUST 7
PRICING SHIFT

DeepSeek 预告整体大幅涨价,"价格屠夫"策略转向

8 月 6 日,DeepSeek 发布官方公告,称"计划近期整体上调 API 服务定价,预计涨幅较大",具体方案以正式通知为准。这是继 7 月中旬引入高峰翻倍计费后,DeepSeek 首次预告全品类提价,且明确指向"整体定价"而非峰谷调整。官方将原因归于 AI 智能体爆发导致单任务 Token 消耗达传统对话的百倍以上,V4-Flash 在 OpenRouter 周调用量已达 7.22 万亿 Token 登顶全球第一,算力成本持续承压。

MODEL UPDATE

OpenAI 免费用户默认升级 GPT-5.6 Luna · Grok 4.6 如期上线

OpenAI 8 月 6 日宣布 ChatGPT 更新:GPT-5.6 Luna 本周成为免费和 Go 用户默认模型,下周起免费用户获得无限次文本聊天和 Think 按钮;Plus/Pro 用户即日使用改进版 GPT-5.6 Sol,新增思考深度滑块。同日 xAI 的 Grok 4.6 按预告如期上线,1.5 万亿参数 V9 基座,所有提升集中在监督微调和强化学习后训练,Grok 4.7(2.1 万亿参数)计划 3-4 周后推出。

CHIP · NVIDIA

英伟达测试降配版 Rubin Ultra

近几周内部测试至少 3 个低 HBM 配置版本,以应对 HBM4E 持续短缺,2027 年 DRAM 供不应求格局延续。

ACQUISITION · AMD

AMD 收购推理芯片初创 Taalas

将模型专属定制硅技术与 Instinct GPU 整合,补强专用推理路线图,部分媒体报交易金额约 14.81 亿美元。

LEGAL · APPLE vs OPENAI

OpenAI 动议驳回苹果商业秘密诉讼

称指控"毫无根据",主张苹果从未明确界定商业秘密;同日 OpenAI 首款硬件细节曝光,甜甜圈音箱定价 300-400 美元。

POLICY · 成都

全国首个 AI 地方政府规章 9 月施行

《成都市促进人工智能产业发展办法》共六章三十六条,覆盖科技创新、产业生态、要素保障、治理体系。

DEEP DIVE · 深度追踪

DeepSeek 涨价与 OpenAI 免费同步发生
大模型定价逻辑正在反转

当 7.22 万亿周调用量撞上算力账单,"烧钱换规模"走到了拐点
02

事件核心事实

7.22万亿
V4-Flash OpenRouter 周调用 Token
百倍
Agent 单任务 Token 消耗对比对话
0美元
OpenAI 免费用户文字聊天价格
■ DeepSeek 端:从"价格屠夫"到理性定价

涨价预告的三个关键信号

  • 范围是"整体定价",不是此前峰谷时段的局部调整,意味着 V4-Flash 和 V4-Pro 两套主力模型均在调价范围内
  • 官方明确归因"需求爆炸式增长 + 算力成本承压 + 行业竞争回归理性",并点名 AI 智能体(如 OpenClaw)单任务 Token 消耗达传统对话百倍以上
  • V4-Flash 在 OpenRouter 以约 0.14 美元/百万输入 Token 的极致低价登顶,单日 Token 消耗高达 8 万亿,巨大调用量正在反向压垮算力经济性
■ OpenAI 端:用免费和高频迭代防守

同一天的反向操作

  • GPT-5.6 Luna 替代 GPT-5.5 Instant 成为免费用户默认模型,事实准确性提升,下周起免费用户文字聊天无限次
  • Plus/Pro 用户获得改进版 GPT-5.6 Sol 和思考深度滑块,Plus 月费仍为 20 美元
  • xAI Grok 4.6 同日上线,1.5 万亿参数,所有提升集中在 SFT/RL 后训练而非规模扩张,维持两周一个旗舰的迭代节奏

1这不是简单的涨价,是价格战的拐点信号

DeepSeek 用极致低价把全球 API 调用量打上去了,但 7.22 万亿周 Token 对应的是实打实的算力账单。当调用量冠军反而亏钱,"烧钱换规模"的逻辑就走到了尽头。涨价预告本质上是承认:低价不可持续。这对所有把 DeepSeek 当作廉价替代品的开发者是直接的成本预警。

2中美厂商正在走两条相反的路,但终点可能相同

DeepSeek 涨价回收成本,OpenAI 把 Luna 下放免费档拉用户——看似反向,实则都是在算同一笔账:谁能把单位推理成本压到最低,谁就掌握下一阶段的定价权。OpenAI 有微软 Azure 和自研芯片兜底,敢免费;DeepSeek 靠国产算力和极致工程化,但调用量上来后边际成本同样压不住。

3Agent 是推高 Token 消耗的真正变量

官方点名"OpenClaw 等智能体单任务 Token 消耗百倍于对话"不是随口一说。当 Agent 从演示走向生产,单次任务从几千 Token 膨胀到几十万甚至上百万,推理成本正在从"按次计费"变成"按任务复杂度计费"。开发者选型逻辑要从"谁的单价最低"转向"谁的单位任务完成成本最低"。

4国产模型集体涨价窗口可能打开

DeepSeek 是国产大模型的价格锚点。它涨,阿里、字节、智谱等跟进的政治压力和商业理由都更充分。过去半年国产模型把 GPT-5.6 Luna 打到降价 80%,现在锚点一松,全行业可能从"比谁更便宜"转向"比谁更能交付结果"。对开发者而言,趁正式涨价前评估替代方案和锁定预算窗口是当务之急。

HARDWARE & POLICY · 硬件与政策

HBM 卡住英伟达 · AMD 收购 Taalas
算力供应链的瓶颈与分化同时加剧

当 GPU 霸主也不得不降配,专用推理芯片的窗口期打开了
03

核心事实

3+
英伟达测试的低 HBM 配置版本数
14.81亿
AMD 收购 Taalas 交易金额(美元)
9月1日
成都 AI 规章正式施行日期
■ 英伟达:HBM 供应倒逼规格妥协

Rubin Ultra 降配测试

  • 据 The Information 报道,英伟达近几周内部测试至少 3 个低 HBM 配置版本的 Rubin Ultra,部分版本显存低于最初公布规格
  • TrendForce 指出,英伟达自 Q3 起已将配置从 HBM4E 12hi 并行评估 HBM4E 8hi、HBM4 12hi、HBM4 8hi 等方案,尚未定案
  • 2027 年 DRAM 供不应求格局将延续,三星和 SK 海力士持续掌握 HBM 价格主导权
■ AMD:用并购补齐专用推理硅

Taalas 收购的战略含义

  • Taalas 成立于 2023 年,由老牌芯片架构师创立,主打为单一 AI 模型硬连线定制芯片,牺牲通用性换取推理性能和效率数量级提升
  • AMD 计划将 Taalas 技术与 Instinct GPU 整合为系统级推理方案,在通用 GPU 之外开辟专用推理赛道
  • AI 推理正成为市场增长最快板块,工作负载日益专业化,通用 GPU 并非所有场景的最优解

1连英伟达都要降配,HBM 瓶颈是真实的

这不是供应链噪音,而是产品路线图层面的妥协。Rubin Ultra 是 2027 年超大规模训练的核心算力硬件,如果最终以降配版本量产,全球大模型训练成本和能力上限都会被内存带宽卡住。三星和 SK 海力士的议价权在未来两年只会更强。

2AMD 买 Taalas 是在买"推理时代的入场券"

训练市场英伟达统治力太强,但推理市场正在碎片化——不同模型、不同场景对芯片的需求差异巨大。Taalas 的模型专属定制硅路线,本质上是在赌"未来推理不需要通用 GPU,需要为模型量身定做的芯片"。这对国产推理芯片创业公司也是一个信号:专用路线有被巨头收购的退出价值。

3成都 AI 规章的示范意义大于实质内容

全国首个 AI 地方政府规章的核心价值不在于六章三十六条写了什么,而在于它标志着国内 AI 监管从中央政策框架进入地方可执行细则阶段。场景开放制度、要素保障、治理体系这些框架性条款,后续配套细则才是关键。南京、杭州、苏州都在推进,成都先落地意味着可以观察执行效果再跟进。

4OpenAI 硬件:65 亿美元的赌注,产品逻辑仍存疑

甜甜圈外形、无屏、带摄像头、300-400 美元、2027 年发售——这些参数加在一起,产品定义仍然模糊。智能音箱市场亚马逊和谷歌耕耘多年未起量,OpenAI 凭 Jony Ive 的设计和 ChatGPT 的 AI 能力能否破局是未知数。但苹果诉讼的激烈程度本身说明:苹果认为这个品类值得打。