美东时间 9 月 3 日(北京时间 9 月 4 日凌晨),GPT-6 Astra 与 Astra Pro 正式发布。官方定调为"全球最智能、最符合人类意图的模型",在计算机操作、网页浏览、软件工程、网络安全、科学研究方向达到新水平。API 定价输入 10 美元、缓存输入 1 美元、输出 50 美元每百万 Token,为上代旗舰 GPT-5.6 Sol 的 2.5 倍;上下文窗口 105 万、最大输出 12.8 万 Token。ARC-AGI-3 得分 99.9%、ExploitBench 100%、GPQA Diamond 96%;电脑使用安全测试违规率从 Sol 的 22.0% 降至 2.4%,绕过限制测试为 0%。模型在得州 Stargate 园区动用超 10 万块 GPU 完成预训练,是 OpenAI 首款由前代模型深度参与训练监督的旗舰。首批仅向 Daybreak 网络安全项目获批组织与企业用户开放,Plus/Pro/Business/Enterprise 用户数日内逐步开放,同步通过 API 和 AWS 提供,高危网络安全能力暂不开放。
据彭博社及第一财经 9 月 3 日报道,字节跳动约 296 亿美元(约合 2100 亿元人民币)银团贷款规模落定,为 2026 年亚洲第二大美元计价贷款,仅次于软银 3 月 400 亿美元过桥贷款。初始目标 200 亿美元,因银行认购订单超 300 亿美元(约 1.5 倍超额认购)扩容;利差 SOFR+68 个基点,低于 2024 年 108 亿美元贷款的 85 个基点,处中国科技公司同类借款最低档;期限 3 年可延至 5 年,花旗与摩根大通任协调行。资金名义为一般企业用途,市场普遍解读为支撑 AI 基建——字节正考虑将 2026 年资本开支提升至最高 700 亿美元(约去年两倍),2027 年或达 1000 亿美元。协议尚未正式签署。对照背景:2026 年上半年亚太(除日本)银团贷款同比下滑约 15%、为 16 年最弱。
总裁布罗克曼在总部网络安全峰会(约 300 名财富 1000 强安全负责人到场)宣布 Daybreak for Frontline Defenders:首期投入 10 亿美元,向供水系统、电网等公用事业扩大开放 AI 网安工具。直接背景是多起疑似 AI 驱动的供水系统攻击与智能体入侵 Hugging Face 事件;奥特曼同日赴北卡站台,网防联盟已扩至 150 余组织。
美东 9 月 3 日上午四大 AI 服务商罕见重叠中断,微软 Copilot 收到大量中断报告,编程工具 Cursor 部分服务受波及。OpenAI 10:43 报告 ChatGPT 与 Codex 错误率升高、12:55 标记解决;Anthropic 称系基础设施问题、除 Opus 4.8/Opus 5 外模型回落基线。两家均未公布根因。
9 月 2 日发布,首批超百家生态伙伴:9 款联名智能硬件首发(Plaud、Rokid、影石、科大讯飞、安克、京东京造等),30 余个行业 Buddy 应用覆盖金融、法律、医疗、教育、公益等 20 多个领域;面向开发者开放 Skill、Expert、Connector 三大能力,账号/任务/记忆/产物跨眼镜、手机、PC、网页同步。定位"Agent 时代的操作系统"。
IFA 2026 上英伟达宣布 RTX Spark Windows PC 10 月上市:Blackwell 架构 GPU 与 Grace CPU 集成单芯片,最高 128GB 统一内存,可本地运行大模型与智能体,宏碁、戴尔、惠普、联想、微软 Surface 等 OEM 参与。同期,7 月牵头成立的开放安全 AI 联盟(OSAA)移交 Linux 基金会中立治理,成员超 120 家,首批成果含智能体行为审计框架 NOOA 与 Safetensors。
马斯克 9 月 2 日在 X 平台预告 Grok 4.7 将于 10 天后上线:参数 2.1 万亿、较 Grok 4.6 的 1.5 万亿增长约 40%,除服务速度外各项指标全面超越前代,Token 使用效率显著提升。GPT-6 发布后 9 天即有竞品卡位,旗舰模型迭代窗口进一步压缩。
99.9% 的 ARC-AGI-3 和 100% 的 ExploitBench 确实刺眼,但拆开看:跃升集中在 Agent 化的电脑操作、浏览器和网安任务,编程这个开发者最关心的付费场景只领先一点点,第三方综合榜还输给了 Fable 5.1。OpenAI 选择在发布会上单方面宣布"AGI 时代",本质是为 2.5 倍涨价预先支付叙事成本——当价格牌先翻了 2.5 倍,就必须给市场一个无法还价的标签。
Astra 输出 50 美元、Fable 5.1 缓存读取 0.25 美元、Kimi 主动兼容两大 API 格式抢工具链——头部实验室的策略已经分化:OpenAI 用超高价锚定"最强 Agent"档位,Anthropic 用缓存降价锁重度 Agent 工作负载,中国厂商用格式兼容和低价挖存量工具用户。对开发团队的直接含义是:"默认用旗舰"的时代结束了,同一个工作流里不同任务档位的模型混搭,将成为成本控制的基本功。
Astra 跨过 Critical 网安阈值的消息 9 月 2 日刚确认,9 月 3 日发布会上高危能力就被锁进 Daybreak 审核制,同日 10 亿美元"前线防御者"计划跟进——开放给供水、电网的是防御侧能力,攻击侧能力留作受控卖点。再加上 OpenAI 牵头的网防联盟扩至 150 余组织,一条"制造威胁感知→受控开放能力→政府与公用事业采购"的商业闭环已经成形。这套模式能跑多快,取决于监管是否允许前沿实验室既当运动员又当安全员。
Astra 通过 AWS 提供不等于对中国大陆开发者可得——无官方通道、合规风险依旧,首日开放名单也不含国内机构。现实的编程工作负载里,Fable 5.1 综合能力仍在 Astra 之上且缓存大降价,Kimi K3、GLM、Qwen 在价格和可得性上继续垫底托底。不要为"AGI"标签冲动迁移技术栈:真正值得跟踪的是 Astra 电脑操作能力向 API 开放后的 Agent 工作流重构,以及 9 月 12 日 Grok 4.7 是否会用 2.1 万亿参数把旗舰价格再搅一局。
主流容灾建议是"接两家以上供应商",但如果备选名单全是美国闭源云,它们共享的底层风险——同一波发布日流量冲击、同类基础设施架构、甚至上游同构的依赖——会在极端时刻同时兑现。85 分钟里第二供应商接住了约 99% 的说法之所以成立,是因为还剩没挂的那一家;下一次如果是区域性云基础设施故障,名单可能更短。
事件发生在 GPT-6 发布当日,流量洪峰与基础设施脆弱性叠加的嫌疑最大,但 OpenAI 与 Anthropic 都只停在"已定位/已修复"的表述。对把核心业务跑在这些 API 上的企业而言,没有根因报告就无法评估复发概率——这和金融机构要求云厂商提供故障复盘是同一个道理。前沿模型越深入关键工作流,"状态页恢复正常"就越不能算事件闭环。
这起事件和 Kimi API 刚刚原生兼容 OpenAI Responses、Anthropic Messages 两种格式放在一起看,结论很实际:把降级链路接到协议兼容的国产模型上,切换成本已经低到只是改一个 base_url 的程度。关键业务(尤其面向国内用户的生产系统)应当至少保留一条不依赖海外单一 API 的降级路径——这不是技术洁癖,是 85 分钟真金白银的教训。