8 月 6 日,DeepSeek 发布官方公告,称"计划近期整体上调 API 服务定价,预计涨幅较大",具体方案以正式通知为准。这是继 7 月中旬引入高峰翻倍计费后,DeepSeek 首次预告全品类提价,且明确指向"整体定价"而非峰谷调整。官方将原因归于 AI 智能体爆发导致单任务 Token 消耗达传统对话的百倍以上,V4-Flash 在 OpenRouter 周调用量已达 7.22 万亿 Token 登顶全球第一,算力成本持续承压。
OpenAI 8 月 6 日宣布 ChatGPT 更新:GPT-5.6 Luna 本周成为免费和 Go 用户默认模型,下周起免费用户获得无限次文本聊天和 Think 按钮;Plus/Pro 用户即日使用改进版 GPT-5.6 Sol,新增思考深度滑块。同日 xAI 的 Grok 4.6 按预告如期上线,1.5 万亿参数 V9 基座,所有提升集中在监督微调和强化学习后训练,Grok 4.7(2.1 万亿参数)计划 3-4 周后推出。
近几周内部测试至少 3 个低 HBM 配置版本,以应对 HBM4E 持续短缺,2027 年 DRAM 供不应求格局延续。
将模型专属定制硅技术与 Instinct GPU 整合,补强专用推理路线图,部分媒体报交易金额约 14.81 亿美元。
称指控"毫无根据",主张苹果从未明确界定商业秘密;同日 OpenAI 首款硬件细节曝光,甜甜圈音箱定价 300-400 美元。
《成都市促进人工智能产业发展办法》共六章三十六条,覆盖科技创新、产业生态、要素保障、治理体系。
DeepSeek 用极致低价把全球 API 调用量打上去了,但 7.22 万亿周 Token 对应的是实打实的算力账单。当调用量冠军反而亏钱,"烧钱换规模"的逻辑就走到了尽头。涨价预告本质上是承认:低价不可持续。这对所有把 DeepSeek 当作廉价替代品的开发者是直接的成本预警。
DeepSeek 涨价回收成本,OpenAI 把 Luna 下放免费档拉用户——看似反向,实则都是在算同一笔账:谁能把单位推理成本压到最低,谁就掌握下一阶段的定价权。OpenAI 有微软 Azure 和自研芯片兜底,敢免费;DeepSeek 靠国产算力和极致工程化,但调用量上来后边际成本同样压不住。
官方点名"OpenClaw 等智能体单任务 Token 消耗百倍于对话"不是随口一说。当 Agent 从演示走向生产,单次任务从几千 Token 膨胀到几十万甚至上百万,推理成本正在从"按次计费"变成"按任务复杂度计费"。开发者选型逻辑要从"谁的单价最低"转向"谁的单位任务完成成本最低"。
DeepSeek 是国产大模型的价格锚点。它涨,阿里、字节、智谱等跟进的政治压力和商业理由都更充分。过去半年国产模型把 GPT-5.6 Luna 打到降价 80%,现在锚点一松,全行业可能从"比谁更便宜"转向"比谁更能交付结果"。对开发者而言,趁正式涨价前评估替代方案和锁定预算窗口是当务之急。
这不是供应链噪音,而是产品路线图层面的妥协。Rubin Ultra 是 2027 年超大规模训练的核心算力硬件,如果最终以降配版本量产,全球大模型训练成本和能力上限都会被内存带宽卡住。三星和 SK 海力士的议价权在未来两年只会更强。
训练市场英伟达统治力太强,但推理市场正在碎片化——不同模型、不同场景对芯片的需求差异巨大。Taalas 的模型专属定制硅路线,本质上是在赌"未来推理不需要通用 GPU,需要为模型量身定做的芯片"。这对国产推理芯片创业公司也是一个信号:专用路线有被巨头收购的退出价值。
全国首个 AI 地方政府规章的核心价值不在于六章三十六条写了什么,而在于它标志着国内 AI 监管从中央政策框架进入地方可执行细则阶段。场景开放制度、要素保障、治理体系这些框架性条款,后续配套细则才是关键。南京、杭州、苏州都在推进,成都先落地意味着可以观察执行效果再跟进。
甜甜圈外形、无屏、带摄像头、300-400 美元、2027 年发售——这些参数加在一起,产品定义仍然模糊。智能音箱市场亚马逊和谷歌耕耘多年未起量,OpenAI 凭 Jony Ive 的设计和 ChatGPT 的 AI 能力能否破局是未知数。但苹果诉讼的激烈程度本身说明:苹果认为这个品类值得打。