阿里巴巴 8 月 3 日正式发布旗舰大模型 Qwen3.8-Max:总参数 2.4 万亿、激活 950 亿、支持 100 万 Token 上下文,是 Qwen 家族迄今参数规模最大的模型,也是千问首次计划开放 Max 级权重。在权威第三方榜单 Arena 上,Qwen 系列整体仅次于 Anthropic Claude 系列,进入全球第一梯队。阿里港股当日上涨 7.26%,市值增加约 1300 亿港元。
OpenRouter 最新周报(7 月 27 日至 8 月 2 日)显示,DeepSeek V4-Flash 以 7.22 万亿 Token 周调用量位居单模型第一。开源项目 OpenCode 平台上,该模型单日处理量一度飙到 8 万亿 Token(5T 免费额度 + 3T 付费)。前五名全部为国产模型:DeepSeek V4-Flash、小米 MiMo-V2.5、腾讯 Hy3、DeepSeek V4 Pro、智谱 GLM5.2。国家超算互联网已于 8 月 2 日正式上线 V4-Flash 正式版 API 与模型文件。
普通用户注册后可直接调用,含免费额度;模型文件同步上线,国产模型官方分发渠道再下一城。
一站式 AI 办公平台,整合 QoderWork/悟空/MuleRun 三款 Agent,由钉钉新任 CEO 陈宇森牵头。
千问首次开放 Max 级权重,与 Kimi K3、MiniMax H3 形成国产开源旗舰连发节奏。
Meta、Anthropic、OpenAI、谷歌 8 月 4 日赴白宫闭门讨论,框架完全自愿但 30 天窗口期成型。
框架名义上不强制,但四家被点名的公司全部是联邦合同、云采购和国会听证的常客,不参与的政治成本远高于参与的技术成本。30 天提前窗口期一旦形成惯例,就会从"自愿安排"滑向"事实准入"——尤其在 Anthropic、OpenAI 接连出事之后,监管叙事已经就位,企业没有公开拒绝的筹码。
财政部、NSA、CISA 共同制定的基准属于机密,企业只知道"是否达标"而不知道"达标线在哪"。这等于把模型能力的定义权交给行政部门:今天评估的是网络攻击能力,明天就可以加上"是否符合美国外交政策利益"。基准保密 + 30 天窗口 + 自愿名义,是一套弹性极大的监管工具箱。
框架直接约束的是美国本土实验室的发布节奏,不会立刻切断 OpenAI、Anthropic API 的大陆访问路径;但 30 天审查窗口一旦稳定运行,意味着海外前沿模型从"内部可用"到"公开可用"之间多出一个政府可控的延迟段。依赖海外模型做产品 Demo、POC、竞品对标的团队,这个时间差需要在产品规划里提前折现。
Qwen3.8-Max 下周开源、DeepSeek V4-Flash 进入国家超算互联网,本质上是在给开发者提供另一条工具链:模型权重在你手里、推理算力在国内超算节点上,监管节奏由国内决定。这不是技术优劣问题,而是供给韧性问题——对政企、应急、金融这类强合规场景尤其关键。一边在加发布前闸门,一边在把开源旗舰和国家级算力底座铺开,两套体系正在各自加固。