← 返回首页
A I · D A I L Y 2026 年 8 月 22 日 · 星期六

Agent 工程化全面提速 · 模型价格战进入深水区

今日看点:DeepSeek 多模态首发 · Codex Harness 开源 · GPT-5.6 Sol 降价 · Slack Code 上线 · 英伟达算力双轨
01

今日头条 · AI 大事记

AUG 22
MODEL RELEASE

DeepSeek 上线首个多模态视觉模型,图片不加价

DeepSeek 在 API 平台上线实验性多模态视觉理解模型 V4-Flash-Vision-Exp,支持 JPEG/PNG/GIF/WebP 图片输入,1M 上下文、384K 输出。定价策略激进:图片按 token 计费,每张最多 384 tokens,价格与 V4-Flash 完全一致——多模态能力不加价。在 Agent 基准测试 Terminal Bench 2.1 上得分 83.9。这是 DeepSeek 首次为 V4 系列补上"眼睛",直接瞄准多模态 Agent 场景。

OPENAI

Codex Harness 全面开源 + GPT-5.6 Sol 降价超 20%

OpenAI 一日双弹。一是将 Codex 底层执行框架 Codex Harness 以 Apache-2.0 协议全面开源——这不是模型权重,而是 Agent 运行时基础设施,Token 消耗降低 6 倍,Greg Brockman 称"Codex 能驱动的远不止编程工具"。二是宣布 GPT-5.6 Sol API 降价三个月:输入 $5→$4、输出 $30→$20 每百万 token,综合降幅 31%。至此 GPT-5.6 全系(Sol/Terra/Luna)完成降价。

AGENT · SLACK

Slack 推出 Slack Code,AI 编程 Agent 进入团队协作

Claude Code、Devin、GitHub Copilot、Vercel 已接入,编程从个人终端搬进共享频道。

AGENT · OPENAI

ChatGPT Mac 端上线 Apple Messages 插件

Agent 首次打通系统级通讯,支持读写 iMessage/SMS/RCS,需完全磁盘访问权限。

SEARCH · MISTRAL

Mistral 发布 Agentic Search,重塑企业检索

五工具多步检索循环替代一次性 RAG,FinanceBench 准确率提升 3 倍。

INFRA · NVIDIA

Vera Rubin 首批机架在 OpenAI 部署运行

下一代算力架构首批落地,标志新一代算力周期正式启动。

CHIP · 出口管制

英伟达中国特供 LPU 芯片传闻遭官方否认

The Information 报道后被迅速否认,黄仁勋称中国市场已拱手让给本土厂商。

PRICING · OPENAI

GPT-5.6 Sol 输出价格直降三分之一

三个月临时降价,100 万 token 典型工作负载成本从 $35 降至 $24。

DEEP DIVE · 深度追踪

Agent 工程化三线齐发
从个人工具到团队协作基础设施

Codex Harness 开源 × Slack Code 上线 × Mistral Agentic Search——Agent 的"操作系统层"正在成型
02

事件核心事实

Codex Harness 开源版 Token 消耗降低
31%
GPT-5.6 Sol 综合成本降幅
Mistral Agentic Search 准确率提升
■ OPENAI CODEX HARNESS 开源

不是模型权重,是 Agent 运行时基础设施

  • Codex Harness 是驱动 Codex App、CLI 和 IDE 扩展运行的核心 Agent 运行时框架
  • Apache-2.0 协议,支持免费商用、二次开发和私有化部署
  • 负责连接模型、用户和工具,管理执行流程——本质是 Agent 的"操作系统"
  • 开源版本 Token 消耗降低 6 倍,模型基准测试分数提升
  • Greg Brockman 明确定位:把 AI 智能体嵌入业务系统,而非停留在编程工具
■ SLACK CODE 上线

编程 Agent 从个人终端走向团队协作平台

  • Slack 推出专用代码频道,Anthropic Claude Code、Cognition Devin、GitHub Copilot、Vercel 首批接入
  • 用户在 Slack 中 @Agent 即创建代码频道,团队实时观察代码变更、计划和 HTML 预览
  • 任务完成后频道自动归档,形成可搜索的协作记录
  • OpenAI ChatGPT 集成即将上线
  • Slack 确认后续将扩展至营销、法律审查、IT 入职等非编码场景
■ MISTRAL AGENTIC SEARCH

多步推理式检索替代一次性 RAG

  • 提供 search / open / navigate / read / grep 五个工具,模型在每次调用后决定下一步动作
  • 像分析师一样逐层深入文档,而非从第一批文本片段中直接回答
  • FinanceBench 和 OfficeQA Pro 基准测试准确率较传统单次检索提升 3 倍
  • Token 消耗和延迟同步降低,支持云端和本地部署
■ 模型层同步动态

DeepSeek 多模态首发 + OpenAI 全系降价

  • DeepSeek V4-Flash-Vision-Exp:首个视觉模型,图片按 token 计费与 V4-Flash 同价,Agent 场景可直接用图片输入
  • OpenAI GPT-5.6 Sol 三个月降价:输入 -20%、输出 -33%,Luna 此前已降 80%、Terra 降 20%
  • ChatGPT Mac 端上线 Apple Messages 插件,Agent 首次打通系统级个人通讯

1Agent 的"操作系统层"正在成型

Codex Harness 开源的是 Agent 运行时,Slack Code 提供的是 Agent 协作界面,Mistral Agentic Search 解决的是 Agent 知识获取——三者叠加,Agent 正在从"能跑"走向"能管、能看、能用"。这对大陆 Agent 开发者的启示很直接:选型不能只看模型能力,运行时框架、协作集成和检索架构同样关键。

2OpenAI 的开源是防御性进攻

Codex Harness 开源的时间点值得玩味——DeepSeek 此前已开源 Harness 框架。OpenAI 选择在此时跟进,且以 Apache-2.0 全开放,本质是在 Agent 运行时层抢占开发者心智。Greg Brockman 说"远不止编程工具",暗示 OpenAI 的野心是成为通用 Agent 平台。大陆开发者现在有两个高质量开源运行时可选,竞争焦点将转向生态和工具链成熟度。

3编程 Agent 的"企业化拐点"

Slack Code 的核心价值不是让 Agent 写代码更快,而是让团队能"看见"Agent 在做什么。审查、反馈、重定向全在一个频道内完成——从"个人偷偷用"到"团队正式用"的转折点。这对企业采用 AI 编程工具是关键一步:透明度和可控性才是企业买单的核心。

4价格战背后:从抢用户到抢 Agent 调用量

GPT-5.6 全系降价 + DeepSeek 多模态不加价,共同指向一个趋势:模型厂商的竞争对手不再是彼此,而是"不用模型"的默认选项。Agent 场景下 Token 消耗是传统对话的百倍以上,降价本质是在抢 Agent 工作流的底层位置。对大陆开发者而言,短期成本利好明确,但需注意 OpenAI 三个月临时降价的窗口期——不宜以此做长期成本模型。

03

算力与芯片博弈

INFRA
■ 英伟达 VERE RUBIN 首批部署

下一代算力架构在 OpenAI 落地

  • OpenAI 基础设施负责人 Uday Ruddarraju 宣布首批 Vera Rubin 机架已到位并运行训练栈
  • 英伟达官方转发确认,双方共同构建加速计算基础设施
  • 这是 Vera Rubin 平台 6 月全面量产以来的首批客户部署,将支持 OpenAI 下一代前沿 AI 预训练
  • 结合此前 5000 亿美元算力融资平台和俄亥俄 8GW 数据中心计划,美国 AI 算力扩张全面加速
■ 英伟达中国特供 LPU 传闻

传闻和否认之间

  • The Information 报道英伟达计划借助 Groq LPU 技术为中国市场打造定制 AI 推理芯片,最快年底小批量出货
  • 英伟达迅速否认:报道不准确,无中国市场 LPU 产品路线图
  • 黄仁勋直言"中国市场已拱手让给本土厂商"
  • 现实:Vera Rubin 架构因出口管制无法对华出口,大陆 AI 推理算力短期只能依赖国产替代和存量芯片