26 7月 星期日 2026 目录
Daily AI Digest

今日 AI 速览

头条


算力基础设施 · NVIDIA 与 SK Group

NVIDIA 与 SK Group 签下 5000 亿美元级 AI 合作:2 GW Vera Rubin 工厂锁定 HBM4

SK Group 与 NVIDIA 合作标识

NVIDIA 与 SK Group 宣布一项超过 5000 亿美元的 AI 基础设施与内存合作。SK Telecom 计划建设 2 GW 规模的 NVIDIA Vera Rubin DSX AI 工厂,由 SK hynix HBM4 提供高带宽内存,首座工厂计划 2027 年投运。Reuters 同期报道,韩国相关 AI 合作总额达到 9500 亿美元,并称 Anthropic 正持续询问未来芯片供应,可能与其探索自研芯片有关,OpenAI 也在争取直接供货。几家公司的交易口径并不等同于短期现金支出,但它们共同指向同一瓶颈:前沿模型竞争正在提前锁定电力、HBM 与先进封装。

点评:模型公司、云厂商和芯片采购团队都该把 HBM 与电力当成产品路线的一部分,不能再等模型定型后才补算力合同。

NVIDIA 官方 / Reuters · 07.25 · 3 源同报
开放权重政策 · 联合公开信

OpenAI 加入开放权重联署,前沿闭源阵营公开分化

支持开放权重与美国 AI 领导力的联合公开信继续扩容。继 NVIDIA、Microsoft、Meta、IBM 与 Hugging Face 等首批签署方之后,OpenAI、Cohere、GitHub、Cisco、Nous Research 与 OpenClaw 等组织新近出现在官方名单中。公开信主张以定向规则处理知识产权和国家安全风险,反对把开放权重本身视作需要全面限制的对象。官方签署页仍在动态更新,因此名单数量不是稳定终点,真正值得关注的是 OpenAI 选择公开站到支持开放权重的一侧,而 Anthropic 仍未列名。

点评:依赖开放模型的产品团队应把这次联署视为政策窗口,尽快梳理许可证、模型来源和可审计部署证据。

联合公开信 · 07.25 · 2 源同报
AI 数据中心 · 电网韧性

一条输电线路故障触发 3.1 GW 数据中心同时脱网,PJM 电网 11 分钟才稳定

美国北弗吉尼亚一条输电线路故障后,附近数据中心在约 30 秒内切换备用电源,电网瞬间失去约 3.1 GW 负载。PJM 数据显示,多余电力峰值达到 3.49 GW,约 11 分钟后系统才恢复稳定。事件没有造成大停电,但区域灯光闪烁,也暴露出大批相邻数据中心采用相同保护阈值时的同步风险。可行改进包括分批脱网与重连,以及用园区级电池让计算负载穿越短时波动,而不是把冲击全部甩给公共电网。

点评:建设或采购 AI 算力的团队应把电网穿越能力写入容量合同,否则算力扩张会把局部故障放大为系统风险。

PJM 数据 / TechCrunch · 07.25 · 3 源同报

Builder 观点


Thibault Sottiaux(OpenAI Codex 与 ChatGPT 团队):他宣布 ChatGPT Work 已向全球所有付费方案开放,覆盖移动端、网页端和桌面端,并用“给 ChatGPT 装上喷气背包”概括它的定位。对产品团队而言,信号不只是多一个入口,而是通用聊天产品正把持续任务执行推向默认体验。

X 原帖 →

Zara Zhang(独立 Builder):她现在最想从模型得到的不是更高智力,而是更快响应。等待 1 至 5 分钟既不足以切换到深度工作,又长到会把人推回信息流,这个尴尬区间正在让 Agent 的交互成本超过模型分数带来的收益。

X 原帖 →

Peter Steinberger(OpenClaw 创建者):他的自动审查 skill 在一次复杂重构上跑到 66 轮,刷新个人纪录。这个数字既说明多轮验证能把 Agent 推进到更深的工程工作,也提醒团队给自动循环设置收敛条件、预算与退出信号,避免把反复修改误当成进展。

X 原帖 →

社区热议


上下文工程 · Claude

Anthropic 为 Claude 5 删掉超过 80% 系统提示词:少给规则,多设计接口

Anthropic 称,在 Claude Opus 5 与 Fable 5 上删除 Claude Code 超过 80% 的系统提示词后,编码评测没有出现可测损失。新的实践从堆叠规则转向让模型使用判断,从提供工具调用示例转向设计清晰接口,并用 skills、延迟工具加载和自动记忆做渐进式披露。团队还把这些检查加入 /doctor,用于压缩 CLAUDE.md 与 skill 文件。HN 讨论在窗口内获得 139 分和 88 条评论,争论焦点是更强模型是否真的减少了提示工程,还是把复杂度移到了工具与评测层。

Claude 官方 / Hacker News · 07.25
网络安全评测 · UK AISI 与 CAISI

Kimi K3 网络攻击能力低于前沿闭源模型,但 10 次中有 1 次走完整条企业攻击链

UK AISI 与美国 CAISI 的初步评测显示,Kimi K3 在 ExploitBench 上得分 32%,高于 GLM-5.2 的 24%,但在 41 个漏洞样本中没有一次走到任意代码执行,领先闭源模型平均达到 20 次。面对 32 步模拟企业网络攻击链,Kimi K3 平均走到第 17 步,领先美国模型平均为 28.5 步;它仍在 10 次尝试中完成过 1 次全链路攻击。评测方还指出,模型防护没有阻止其协助漏洞利用开发。结果来自有限基准且关闭了部分对照模型的系统级拒答,不能直接等同于真实世界攻击率。

点评:准备部署开放权重 Agent 的安全团队应按最坏一次成功来设计隔离,而不是只看平均能力落后多少。

NIST / Hacker News · 07.25
开源治理 · Debian

Debian 讨论 AI 辅助贡献边界:许可证、披露和最终责任成为核心条件

Debian 开发者正在通过一般决议讨论 LLM 与生成式 AI 是否可以参与项目贡献。允许方案要求提交者核验工具条款与第三方许可证,对技术质量、安全和可维护性承担全部责任,并在大段内容直接来自工具时用 Generated-ByAssisted-By 等标记披露;批量自动修改还要事先讨论并由人监督。反对方案则主张全面禁止,另有折中意见要求在实际可行范围内尽量拒绝。讨论尚未形成项目政策,不应把任一草案当成最终决定。

Debian 邮件列表 / IT之家 · 07.25

GitHub 趋势


GitHub Trending · 今日 577 星

awesome-claude-skills:集中整理 Claude Skills、资源与工作流

ComposioHQ 的清单收集 Claude Skills、示例和定制工作流,方便开发者按任务寻找可复用能力。仓库约 70.6k 星,当前 API 未识别到明确许可证。它适合做发现入口,但第三方 skill 可能包含脚本、网络访问和持久化配置,安装前仍应逐项审查来源与权限。

Python · 未标许可证 · 约 70.6k 星
GitHub Trending · 今日 319 星

Kronos:面向金融市场语言的基础模型

Kronos 把金融市场序列作为专门建模对象,仓库提供模型与研究实现入口。项目采用 MIT,约 33.8k 星。金融时序很容易受到数据泄漏、市场状态变化和交易成本影响,因此任何回测结果都应在独立时间段、真实费率和延迟约束下复核。

Python · MIT · 约 33.8k 星
GitHub Trending · 今日 210 星

Strix:用 AI 自动发现并修复应用漏洞

Strix 是开源 AI 渗透测试工具,目标是自动寻找应用漏洞并协助修复。仓库采用 Apache-2.0,约 44.2k 星。此类 Agent 会主动探测目标并执行高风险操作,只应在书面授权范围、隔离环境和明确速率限制下使用,同时保留完整操作日志供复核。

Python · Apache-2.0 · 约 44.2k 星
编辑点评

今天的主线是规模扩张与控制面同步前移。NVIDIA 和 SK Group 把未来数年的 HBM、电力与工厂容量提前锁进合同,开放权重联盟则争夺模型生态的政策空间。另一边,Claude 的上下文工程在删规则,安全评测与 Debian 治理却在补边界。更强 Agent 不会让系统设计消失,它只会把关键工作从提示词搬到接口、权限、评测和基础设施。