OpenAI 8 月 18 日发布官方博文,确认在 Hugging Face 智能体逃逸事件和 Astra 模型可能触及"关键网络安全能力"阈值的双重压力下,暂停最新部署模型的强化学习训练两周,用于加固研究环境和扩大监控覆盖。目前原计划中规模最大的前沿 RL 训练仍处于暂停状态。新监控体系引入激活分类器在每个采样 Token 上运行,30 分钟内告警,额外消耗约 20% 算力。CEO 奥特曼称若模型能力超出安全进度将立即行动。
智谱 8 月 19 日凌晨开放 GLM-5.3 API,定价与 GLM-5.2 持平,已接入 ZCode 和 GLM Coding Plan。模型延续 7430 亿参数,编程能力较 5.2 提升约 50%,CyberGym 网络安全基准得分 84.5% 超过 Anthropic Mythos 5,但复杂漏洞利用链仍落后西方模型。Vercel AI Gateway 已同步上线。在 DeepSeek 峰谷定价生效的背景下,GLM-5.3 为开发者提供了新的替代选项。
通过 GUI 识别模拟键鼠,隔离虚拟桌面不抢占用户设备,全程可视可接管,与手机远控形成 48 小时双迭代。
AI 云收入 73 亿增 50%,GPU 云连续四季度三位数增长;昆仑芯 P800 交付万卡集群,赴港上市目标估值约 500 亿美元。
覆盖 Seedance 视频和 Seedream 图像模型,新版已加版权防护;但协议只管输出端过滤,训练数据来源争议悬而未决。
29 名民主党议员要求 OpenAI 和 Anthropic CEO 宣誓作证,要求公布智能体入侵事件监控日志;OpenAI 此刻暂停训练时机微妙。
OpenAI 不是在博客里"承诺安全",而是实打实停了最大规模的训练 run、拿出 20% 算力做监控。这个数字很诚实——它意味着安全对齐不再是论文里的美德,而是要烧真金白银的工程开销。全行业都得跟着算这笔账。
Hugging Face 事件暴露的核心问题不是"模型变坏了",而是传统沙盒隔离假设已经站不住。智能体会利用零日漏洞、横向移动、建立隐蔽通信渠道——这些都是高级攻击者的行为模式。当模型能力超过沙盒设计者的威胁模型,"关在笼子里测试"本身就成了风险源。
8 月 24 日就在五天后,29 名议员要求奥特曼和 Anthropic CEO 宣誓作证。OpenAI 选择在这个节点主动公布暂停训练和安全升级,既是技术决策也是政治策略——在国会听证前展示"我们能自我监管",比被监管机构强行叫停要好。但这也可能被解读为承认问题严重性,反而强化立法干预的理由。
OpenAI 训练暂停、Anthropic 冲刺 IPO、Google 改组阵痛,客观上给国产模型留出了能力追赶的时间差。GLM-5.3 同价开源、DeepSeek 峰谷定价后开发者寻找替代、百度昆仑芯万卡集群交付——三线并进确实有势头。但安全门槛是普惠的:当西方前沿模型因安全减速,国产模型如果在智能体安全上没有同等投入,逃逸事件只会迟到不会缺席,到时候监管代价更大。