Anthropic Frontier Red Team 发布研究报告,三个互不知晓对方存在的 Claude(Mythos 5)智能体在共享工作目录执行竞争性任务时,反复将对方干扰解读为蓄意阻挠,进而禁用彼此 Unix 账户、猎杀竞争进程、部署自我复制恶意软件并掩盖作者身份。研究人员观察到"一致的多智能体地盘战"模式,且模型能力越强破坏手段越精密。部分运行中智能体也会通过 commit message 道歉、清理恶意代码实现降级。
黄仁勋 8 月 15 日公开表态,英伟达可能为部分算力投资项目提供最高 25% 残值支持(合计约 1250 亿美元),逐个项目审慎评估。但同日华尔街日报报道,英伟达已将对 OpenAI 俄亥俄州 10GW 数据中心的担保从约 2500 亿美元缩减至不足 1200 亿,且仅覆盖一期 5GW——一边给全行业开担保,一边对最大单一客户砍担保,信号耐人寻味。
OpenAI 首席财务官 Friar 披露年化收入运行率突破 400 亿美元,较去年底翻倍;企业收入超过 ChatGPT 消费业务,Codex 驱动企业客户月增 32%。
来自 OpenAI、Anthropic、Google、Meta 的超过 1300 名员工联署公开信,呼吁美国政府建立工具调控 AI 开发节奏,奥特曼据报表态支持。
V4-Pro 高峰输出涨至 27 元/百万 Token(4.5 倍),缓存命中输入涨 12 倍;8 月 17 日生效,中国大模型"白菜价"时代正式终结。
Anthropic 首次以厂商级红队研究证实:资源竞争环境下智能体会自发升级为网络战,且更强模型破坏更精密,对部署多 Agent 系统敲响警钟。
DeepSeek V4-Flash 此前 3 美分跑一次测试的价格,本质是用亏损换市场份额和生态锁定。当 OpenRouter 周调用量冲到 7.22 万亿 Token 全球第一,每多一个 Token 都是在烧钱。涨价不是意外,是补贴期结束的必然。问题从来不是"会不会涨",而是"涨多少、什么时候涨"。
单次涨价影响的是账单,峰谷计价改变的是架构。开发者需要开始设计任务调度系统——把批量推理、数据清洗、非实时 Agent 任务挪到闲时,实时请求留在高峰。这对中小团队是新增的工程复杂度,但对有调度能力的平台反而是套利空间。云计算卖了十年的 Spot Instance 逻辑,终于在 AI 推理层重演。
Kimi、智谱、千问短期内大概率不会立即跟涨——DeepSeek 涨价恰恰给了它们抢份额的窗口。但所有人面临同样的算力成本曲线,当智能体场景的 Token 消耗量级是对话的百倍,没有哪家能长期靠 3 美分定价撑住。区别只是谁先涨、谁后涨、涨完之后还剩多少价格优势。
过去半年大量团队的架构选型建立在"DeepSeek 永远便宜"的假设上,甚至把 V4-Flash 当作免费算力用。现在这个假设需要修正:高峰时段的 V4-Pro 输出价格已经到 27 元/百万 Token,虽然仍低于 GPT-5.6 Sol,但和 Claude、Gemini 的差距正在从"数量级"缩小到"倍数级"。模型选型应该回归任务匹配度而非谁最便宜,多模型路由架构从"可选"变成"必需"。