DeepSeek 在 API 平台上线实验性多模态视觉理解模型 V4-Flash-Vision-Exp,支持 JPEG/PNG/GIF/WebP 图片输入,1M 上下文、384K 输出。定价策略激进:图片按 token 计费,每张最多 384 tokens,价格与 V4-Flash 完全一致——多模态能力不加价。在 Agent 基准测试 Terminal Bench 2.1 上得分 83.9。这是 DeepSeek 首次为 V4 系列补上"眼睛",直接瞄准多模态 Agent 场景。
OpenAI 一日双弹。一是将 Codex 底层执行框架 Codex Harness 以 Apache-2.0 协议全面开源——这不是模型权重,而是 Agent 运行时基础设施,Token 消耗降低 6 倍,Greg Brockman 称"Codex 能驱动的远不止编程工具"。二是宣布 GPT-5.6 Sol API 降价三个月:输入 $5→$4、输出 $30→$20 每百万 token,综合降幅 31%。至此 GPT-5.6 全系(Sol/Terra/Luna)完成降价。
Claude Code、Devin、GitHub Copilot、Vercel 已接入,编程从个人终端搬进共享频道。
Agent 首次打通系统级通讯,支持读写 iMessage/SMS/RCS,需完全磁盘访问权限。
五工具多步检索循环替代一次性 RAG,FinanceBench 准确率提升 3 倍。
下一代算力架构首批落地,标志新一代算力周期正式启动。
The Information 报道后被迅速否认,黄仁勋称中国市场已拱手让给本土厂商。
三个月临时降价,100 万 token 典型工作负载成本从 $35 降至 $24。
Codex Harness 开源的是 Agent 运行时,Slack Code 提供的是 Agent 协作界面,Mistral Agentic Search 解决的是 Agent 知识获取——三者叠加,Agent 正在从"能跑"走向"能管、能看、能用"。这对大陆 Agent 开发者的启示很直接:选型不能只看模型能力,运行时框架、协作集成和检索架构同样关键。
Codex Harness 开源的时间点值得玩味——DeepSeek 此前已开源 Harness 框架。OpenAI 选择在此时跟进,且以 Apache-2.0 全开放,本质是在 Agent 运行时层抢占开发者心智。Greg Brockman 说"远不止编程工具",暗示 OpenAI 的野心是成为通用 Agent 平台。大陆开发者现在有两个高质量开源运行时可选,竞争焦点将转向生态和工具链成熟度。
Slack Code 的核心价值不是让 Agent 写代码更快,而是让团队能"看见"Agent 在做什么。审查、反馈、重定向全在一个频道内完成——从"个人偷偷用"到"团队正式用"的转折点。这对企业采用 AI 编程工具是关键一步:透明度和可控性才是企业买单的核心。
GPT-5.6 全系降价 + DeepSeek 多模态不加价,共同指向一个趋势:模型厂商的竞争对手不再是彼此,而是"不用模型"的默认选项。Agent 场景下 Token 消耗是传统对话的百倍以上,降价本质是在抢 Agent 工作流的底层位置。对大陆开发者而言,短期成本利好明确,但需注意 OpenAI 三个月临时降价的窗口期——不宜以此做长期成本模型。