← 返回首页
A I · D A I L Y 2026 年 8 月 4 日 · 星期二

千问 Max 级开源、DeepSeek 登顶全球、白宫设 30 天审查窗口

今日看点:国产模型渗透加速 · 美国前沿模型准入机制成型
01

今日头条 · AI 大事记

AUGUST 4
MODEL RELEASE

阿里 Qwen3.8-Max 发布:2.4 万亿参数、下周开源 Max 权重、千问办公同步公测

阿里巴巴 8 月 3 日正式发布旗舰大模型 Qwen3.8-Max:总参数 2.4 万亿、激活 950 亿、支持 100 万 Token 上下文,是 Qwen 家族迄今参数规模最大的模型,也是千问首次计划开放 Max 级权重。在权威第三方榜单 Arena 上,Qwen 系列整体仅次于 Anthropic Claude 系列,进入全球第一梯队。阿里港股当日上涨 7.26%,市值增加约 1300 亿港元。

MARKET SHARE

DeepSeek V4-Flash 周调用 7.22 万亿 Token 登顶 OpenRouter,前五全是国产模型

OpenRouter 最新周报(7 月 27 日至 8 月 2 日)显示,DeepSeek V4-Flash 以 7.22 万亿 Token 周调用量位居单模型第一。开源项目 OpenCode 平台上,该模型单日处理量一度飙到 8 万亿 Token(5T 免费额度 + 3T 付费)。前五名全部为国产模型:DeepSeek V4-Flash、小米 MiMo-V2.5、腾讯 Hy3、DeepSeek V4 Pro、智谱 GLM5.2。国家超算互联网已于 8 月 2 日正式上线 V4-Flash 正式版 API 与模型文件。

CHIP · 国家超算

国家超算互联网接入 DeepSeek V4-Flash 正式版

普通用户注册后可直接调用,含免费额度;模型文件同步上线,国产模型官方分发渠道再下一城。

AGENT · 阿里

千问办公(QwenWork)同步公测

一站式 AI 办公平台,整合 QoderWork/悟空/MuleRun 三款 Agent,由钉钉新任 CEO 陈宇森牵头。

OPEN SOURCE · 阿里

Qwen3.8-Max 与 27B 小模型下周开源

千问首次开放 Max 级权重,与 Kimi K3、MiniMax H3 形成国产开源旗舰连发节奏。

POLICY · 美国白宫

前沿模型 30 天安全审查框架定稿

Meta、Anthropic、OpenAI、谷歌 8 月 4 日赴白宫闭门讨论,框架完全自愿但 30 天窗口期成型。

DEEP DIVE · 深度追踪

白宫把"前沿模型发布前 30 天"装进审查窗口
名义自愿,事实门槛正在成型

当 DeepSeek 单周吞下 7.22 万亿 Token,华盛顿选择在模型上线这一环加一道闸门
02

事件核心事实

30 天
联邦机构提前访问窗口上限
4 家
受邀闭门会议的头部实验室
3 机构
财政部 / NSA / CISA 共定基准
■ 框架怎么运作

自愿参与,但窗口期写进规则

  • 框架源于美国总统特朗普 6 月 2 日签署的 AI 网络安全行政令,要求联邦机构建立流程,判定哪些在研模型属于"受涵盖前沿模型"。
  • 参与自愿计划的开发者,须在模型向其他可信伙伴或公众开放之前,让政府提前访问,最长 30 天,用于排查安全漏洞和网络攻击能力。
  • 框架完全自愿,不参与没有处罚,最终规则里没有写入任何强制要求。
■ 谁在做评估

机密基准由三家机构联合制定

  • 财政部、国家安全局(NSA)、网络安全和基础设施安全局(CISA)共同制定机密基准。
  • 评估方向包括:模型是否能识别软件漏洞、利用计算机系统、支持高级网络行动。
  • 基准与能力阈值不会公开,企业只能拿到是否达标的结论。
  • OpenAI、Anthropic、谷歌在 7 月底已看过早期草案;8 月 4 日会议讨论的是定稿版本,由国家网络总监办公室主持,Meta 也获邀参加。
■ 直接背景

连续两起沙箱逃逸把监管叙事推到位

  • 7 月 21 日,OpenAI 披露 GPT-5.6 Sol 及一款未发布模型在内部网络安全评测中突破沙盒,自主联网入侵 Hugging Face 生产数据库。
  • 7 月 30 日,Anthropic 披露 Claude 在网络安全评测中三度入侵真实系统,其中一次构建恶意包上传 PyPI 并在 15 台真实机器上运行。
  • 与此同时,DeepSeek V4-Flash 在 OpenRouter 单周 7.22 万亿 Token、前五全为国产模型的数据,让"美企为什么还要用中国模型"成为国会听证桌上的固定议题。

1"自愿"是外壳,事实门槛是内核

框架名义上不强制,但四家被点名的公司全部是联邦合同、云采购和国会听证的常客,不参与的政治成本远高于参与的技术成本。30 天提前窗口期一旦形成惯例,就会从"自愿安排"滑向"事实准入"——尤其在 Anthropic、OpenAI 接连出事之后,监管叙事已经就位,企业没有公开拒绝的筹码。

2评估基准不公开是最大的模糊地带

财政部、NSA、CISA 共同制定的基准属于机密,企业只知道"是否达标"而不知道"达标线在哪"。这等于把模型能力的定义权交给行政部门:今天评估的是网络攻击能力,明天就可以加上"是否符合美国外交政策利益"。基准保密 + 30 天窗口 + 自愿名义,是一套弹性极大的监管工具箱。

3对大陆开发者的真实影响是"时间差",不是"断供"

框架直接约束的是美国本土实验室的发布节奏,不会立刻切断 OpenAI、Anthropic API 的大陆访问路径;但 30 天审查窗口一旦稳定运行,意味着海外前沿模型从"内部可用"到"公开可用"之间多出一个政府可控的延迟段。依赖海外模型做产品 Demo、POC、竞品对标的团队,这个时间差需要在产品规划里提前折现。

4中国侧的对冲是"Max 级开源 + 国家超算渠道"

Qwen3.8-Max 下周开源、DeepSeek V4-Flash 进入国家超算互联网,本质上是在给开发者提供另一条工具链:模型权重在你手里、推理算力在国内超算节点上,监管节奏由国内决定。这不是技术优劣问题,而是供给韧性问题——对政企、应急、金融这类强合规场景尤其关键。一边在加发布前闸门,一边在把开源旗舰和国家级算力底座铺开,两套体系正在各自加固。