据彭博社8月22日报道,英伟达部分最大客户已被告知,由于高带宽内存HBM和LPDDR5X等存储芯片成本飙升,搭载英伟达AI芯片的服务器价格将在多数情况下上涨超过15%。涨价适用于2027年初发货的系统,涵盖旗舰级Vera Rubin和Grace Blackwell平台整机。为微软、谷歌、甲骨文等代工生产服务器的企业已通知客户即将涨价。分析指出,HBM已取代GPU本身成为AI服务器系统中最大的成本组件。
中央网络安全和信息化委员会8月21日印发《促进网信企业高质量发展行动计划(2026-2030年)》,明确加快推进人工智能等新兴领域立法;支持企业研发高端AI芯片、突破高性能训练集群关键技术、提升大语言模型/多模态模型/世界模型性能、布局智能体和具身智能;鼓励企业参与开源项目和开源社区建设。
港科大+复旦团队论文被ISSTA 2026接收,通过工具参数窃取系统提示词再双通道注入实现RCE。Cursor+GPT-5攻击成功率1.0,Claude Code守卫模型被主模型推翻。新版Claude Code降至0,但Cline/Windsurf/Trae仍为1。
"算力银行"支持企业存入闲置算力跨区域调度支取,"算力超市"按卡时/核时/Token灵活计费。目标打破厂商算力孤岛,推动算力从重资产转向轻服务,降低中小企业用算门槛。
呼和浩特与乌兰察布签约13个项目,较去年约200亿增长约5.8倍。火山引擎GW级园区、寒武纪芯片实验室、协鑫能科算电一体化等落地,同步启动"词元出海"平台和全国视频大模型算力基地。
OpenAI下调GPT-5.6 Sol价格超20%,同期英伟达服务器涨价、中国密集出台算力政策。模型层降价与基础设施层涨价形成剪刀差,算力成本压力正在重塑全球AI产业链利润分配。
把这笔账算到"英伟达贪婪"上是误读。GPU本身的制程红利还在,但HBM3E/HBM4的产能被SK海力士、三星、美光三家锁死,AI训练和推理对内存带宽的需求增长速度超过了GPU算力本身。英伟达只是把上游成本传导出去,真正的定价权在内存三巨头手里。这对中国的启示很直接:只做GPU不做HBM,算力自主就是半句空话。
OpenAI把GPT-5.6 Sol降价20%+,DeepSeek搞峰谷定价,看起来API越来越便宜。但底层算力成本在涨,这意味着云厂商和模型厂商的利润空间正在被两头挤压。短期消费者受益,但中期看,没有自有算力的纯模型API厂商会先撑不住——算力成本涨15%不是靠优化推理引擎能消化的。大陆开发者如果重度依赖海外API,应该趁降价期锁定长期合约。
内蒙古签约从200亿跳到1361亿很吸引眼球,但签约额≠到位资金,这类大会签约项目通常分期落地、存在水分。真正有价值的信号是寒武纪芯片实验室落地——国产芯片从"被讨论"进入"被采购"阶段。不过要清醒:寒武纪在训练场景与英伟达的差距仍然是代际级的,推理场景的替代进度比训练快得多,别用一个签约数字就喊"弯道超车"。
ToolLeak攻击最值得关注的不是"六款工具全中招"这个标题,而是论文指出的根本缺陷:工具返回值既是数据又是指令,两者没有边界。Claude Code用Haiku做守卫模型但被Sonnet推翻,说明模型层面的安全防线在被污染的上下文面前形同虚设。新版Claude Code靠"渐进式工具描述暴露"这种架构隔离才把RCE降到0,但Cline/Windsurf/Trae仍然100%中招。对国内开发者来说,MCP工具生态越繁荣,这个攻击面越大,架构级安全标准不能等。