← 返回首页
A I · D A I L Y 2026 年 8 月 14 日 · 星期四

四国模型同日开战 · 速度、价格与开源三条战线同时打响

今日看点:14倍速推理 · 三周半价迭代 · DeepSeek双发 · 万亿权重开源
01

今日头条 · AI 大事记

AUG 14
INFRASTRUCTURE

OpenAI 联合 Cerebras 推出 GPT-5.6 Sol Ultrafast:14 倍速推理

OpenAI 发布 Ultrafast 模式限量预览,由 Cerebras 晶圆级引擎提供算力,输出速度最高达 750 tokens/秒,较 Standard 模式快 14 倍,官方称不降低模型质量。该模式率先通过 API 开放,瞄准对延迟敏感的企业工作流。横向对比,加速后比 Anthropic Fable 5 快 11 倍,比 Opus 4.8 Fast 模式快 5 倍。

MODEL RELEASE

DeepSeek V4 Pro 正式版上线 · Harness 智能体框架 MIT 开源

DeepSeek 同日双发:V4 Pro 正式版(1.6T MoE、49B 激活、100 万 Token 上下文、384K 输出,Agent 能力较预览版提升近 5 倍),API 定价约为 GPT-5.6 Sol 的六十分之一;Harness 开发者预览版以 MIT 协议开源,基于 Cordis 插件系统,工具/沙箱/文件系统/编排全可替换,持久化会话支持恢复、分支和回放,直接对标 Claude Code。

MODEL · GOOGLE

Gemini 3.7 Flash 三周极速发布并半价促销

距 3.6 仅三周,编程得分 34.4%→43.6%,Terminal-bench 3.0 从 5.4% 跃至 14.9%。API 至年底输入 $0.75/输出 $3.75 每百万 Token,2027 年翻倍。

OPEN SOURCE · ALIBABA

阿里首次开源 Max 级旗舰 Qwen3.8-2.4T

2.4 万亿总参数、950 亿激活、原生 256K 上下文可扩展至百万。权重在魔搭和 Hugging Face 同步开放,但开源版裁掉视觉能力和百万上下文。

SPEED · CEREBRAS

非英伟达算力路径首次跑通旗舰模型

Cerebras 晶圆级引擎支撑 GPT-5.6 Sol 达到 750 tokens/秒,标志着推理层"去英伟达化"从论文走向产品级交付。

PRICE WAR · API

前沿模型定价进入"分角"时代

DeepSeek V4 Pro 输入 $0.435/百万 Token,谷歌 Flash 促销 $0.75,两者均远低于 GPT-5.6 Terra 的 $2.00 和 Claude Sonnet 5 的 $2.00。

DEEP DIVE · 深度追踪

推理速度 14 倍与 API 半价:
海外巨头的"速度+价格"双线绞杀

当模型智能差距缩小,竞争维度正在从"谁更聪明"转向"谁更快、更便宜"
02

事件核心事实

750 tok/s
GPT-5.6 Sol Ultrafast 输出速度
14×
较 Standard 模式加速倍数
50%
Gemini 3.7 Flash API 促销降幅
■ OpenAI × Cerebras

晶圆级引擎首次支撑旗舰模型推理

  • Ultrafast 模式由 Cerebras 晶圆级引擎提供算力,非英伟达 GPU 路径
  • 输出速度最高 750 tokens/秒,Standard 模式基线约 53 tokens/秒
  • 率先通过 API 向企业用户开放限量预览,瞄准实时编码、客服等高并发低延迟场景
  • 对比:比 Fable 5 快 11 倍,比 Opus 4.8 Fast 模式快 5 倍
■ 谷歌 Gemini 3.7 Flash

三周迭代,编程与 Agent 能力大幅跳升

  • 距 3.6 Flash 发布仅三周,FrontierCode 生产代码质量从 34.4% 升至 43.6%
  • Terminal-bench 3.0 通用智能体能力从 5.4% 跃升至 14.9%(接近三倍)
  • AutomationBench 企业工作流自动化从 17.0% 升至 30.4%
  • API 促销价至年底:输入 $0.75/输出 $3.75 每百万 Token(半价);2027 年 1 月翻倍
  • Vercel 等平台已首日上线支持

1速度是新的护城河,但不是 Cerebras 的护城河

750 tokens/秒确实改变了实时交互体验,但 Cerebras 在这个合作里更像是 OpenAI 的"速度外包商"而非算力伙伴——OpenAI 随时可以把同样的工作负载迁移到自研芯片或其他推理优化方案上。对 Cerebras 而言,能跑旗舰模型是最好的广告,但商业可持续性取决于 OpenAI 是否愿意长期付费,而非自有客户粘性。

2谷歌的"三周半价"是焦虑而非从容

Flash 系列三周一发、还自砍半价,说明谷歌在编程和 Agent 赛道面临的压力远超外界想象。3.6 到 3.7 的提升幅度(Terminal-bench 接近三倍)不像是正常迭代节奏,更像是紧急追赶。半价促销到年底再翻倍的定价策略,本质是用短期补贴抢开发者心智——但 2027 年涨价后能不能留住人,才是真正的考验。

3推理层正在"商品化",利润向上游和应用端转移

当 OpenAI 自己都用第三方芯片跑旗舰模型、谷歌把 Flash 砍到 $0.75,推理本身的溢价正在快速塌缩。未来的利润分布会更极端:底层壁垒在自研芯片和晶圆级硬件(英伟达、Cerebras、谷歌 TPU),上层壁垒在数据飞轮和 Agent 工作流(Anthropic 的企业客户、OpenAI 的消费端入口),中间纯粹提供推理 API 的厂商空间会被持续挤压。

4对大陆开发者的实际影响

OpenAI Ultrafast 目前仅 API 限量预览,且需要企业级访问,大陆开发者短期难以直接使用;Gemini 3.7 Flash 半价促销对使用 Google Cloud 的国内出海团队是实质利好。但更关键的信号是:海外巨头主动把价格和速度拉到这个水平,会进一步压缩国内"套壳 API"厂商的生存空间——靠转发 GPT/Claude API 赚差价的模式,在 $0.75 的 Flash 和 $0.435 的 DeepSeek 之间已经没有缝隙。

DEEP DIVE · 深度追踪

DeepSeek 双发与阿里万亿开源:
中国 AI 的"低价+开放"组合拳

同一天,一个用六十分之一的价格对标 GPT-5.6 Sol,一个把万亿级旗舰权重放上 Hugging Face
03

事件核心事实

1/60
V4 Pro 价格相对 GPT-5.6 Sol
2.4T
Qwen3.8 开源模型总参数量
MIT
Harness 开源协议(商业自由)
■ DeepSeek V4 Pro + Harness

模型转正与框架开源同日落地

  • V4 Pro 正式版:1.6T MoE 架构、49B 激活参数、100 万 Token 上下文、384K 输出,Agent 能力较预览版提升近 5 倍
  • API 定价:输入 $0.435/输出 $0.87 每百万 Token(缓存命中输入更低),约为 GPT-5.6 Sol 的六十分之一
  • Harness 开发者预览版:以 MIT 协议开源,基于 Cordis 插件系统,工具/沙箱/会话/文件系统/编排/UI 组件全可替换
  • 持久化会话日志记录提示、工具调用和结果,支持运行恢复、分支和回放
  • 提供 npx 启动和本地 Web 界面,但官方警告预览版存在兼容性问题
■ 阿里 Qwen3.8-2.4T-A95B

首次开源 Max 级别旗舰权重

  • 总参数 2.4 万亿,每 Token 激活 950 亿,原生 262,144 Token 上下文,可扩展至约 100 万
  • 权重在魔搭社区和 Hugging Face 同步开放,采用自定义许可,含商业规模触发条款
  • 关键裁剪:开源版本不含视觉能力和 100 万上下文(完整版需通过 API 获取)
  • 英伟达首次测试使用 72-GPU 机架,意味着私有化部署门槛不低

1DeepSeek 的真正杀招不是便宜的模型,是开源的 Harness

V4 Pro 六十分之一的定价固然抢眼,但模型价格战已经打了一年多,边际效应在递减。真正有战略意义的是 Harness 以 MIT 协议开源——这意味着任何企业都可以基于它搭建自己的 Claude Code/Cursor 竞品,且无需开源衍生作品。DeepSeek 在用"免费框架+低价模型"的组合,锁定开发者的 Agent 工作流标准,这比单纯卖 API 有更深的生态野心。

2阿里的开源是"半开门"——权重放了,能力留了一手

万亿级旗舰首次开源权重确实是里程碑,但开源版裁掉视觉和百万上下文这两个最有企业价值的能力,说明阿里并不打算把 Max 级的完整能力免费送出。自定义许可加商业规模触发条款,也意味着大企业用起来仍然要谈商务。这是"开源换生态、闭源保收入"的经典平衡术,和 Meta 当年 Llama 的策略如出一辙,但商业条款更激进。

372-GPU 机架的门槛:开源不等于可部署

Qwen3.8-2.4T 首次测试用了 72 张 GPU,这个数字意味着绝大多数中小企业和创业公司根本无法自行部署。开源权重的象征意义大于实际可用性——真正能跑起来的是云厂商和大型企业。这反而强化了阿里云作为"首选托管方"的地位:权重开源了,但你大概率还是要在阿里云上调用。这与 DeepSeek Harness 的 MIT 低门槛形成鲜明对比,两条路线代表了中国 AI 开源的两种思路。

4中美 AI 竞争正在进入"模式之争"而非"参数之争"

8 月 13 日这一天的四组发布,表面是模型和价格的竞争,底层是两种产业路线的对撞:美国走"闭源旗舰+推理加速+API 商品化"(OpenAI、谷歌),中国走"低价模型+开源框架+生态锁定"(DeepSeek、阿里)。前者在单模型能力和基础设施上仍有优势,后者在开发者渗透和成本控制上更激进。对大陆开发者而言,真正的机会在于:当海外模型越来越贵、越来越受限时,国产开源框架+低价模型的组合正在成为可落地的替代方案。