今日 AI 速览
头条
InstantDB 团队加入 OpenAI,现有云服务给用户一年迁移期
InstantDB 团队宣布加入 OpenAI,并停止接受新用户。官方说,InstantDB 已服务 1.7 万名用户、40 万个应用,处理过 25 亿笔事务。现有用户可以在未来 12 个月迁移,7 月 31 日以后开始的订阅会退款。
InstantDB 云端应用计划在 2027 年 8 月 31 日关闭,备份保留到 2028 年 8 月 31 日。项目代码继续开源,官方也会提供自托管指南。团队没有说明加入 OpenAI 后具体负责什么产品。
点评:正在使用 InstantDB 的团队应先导出数据、盘点依赖并安排迁移演练;开源代码还在,不代表托管服务会一直可用。
英伟达客户被曝收到 AI 服务器涨价通知,部分涨幅超过 15%
彭博社援引知情人士称,英伟达一些大客户接到通知,含英伟达 AI 芯片的服务器价格在许多情况下会涨超 15%,影响重点是 2027 年初交付的系统。报道把涨价原因指向内存成本上升,并提到 Vera Rubin 与 Grace Blackwell 平台。
路透社转述这项报道时说,无法独立核实相关信息。英伟达也没有在公开渠道确认统一涨价幅度,因此目前不能把 15% 当成所有产品、客户或地区的正式价目表。
点评:准备采购 2027 年算力的团队应要求供应商给出逐项报价和有效期,并把内存、整机与交付时间分别写进预算情景。
工具与产品
Check Point 给企业 AI Agent 清单补上 Token 用量视图
Check Point 在 Workforce AI Security Inventory 中新增 Agent Token 用量。管理员现在可以查看受支持 Agent 的总用量,以及过去 24 小时、7 天和 30 天的变化,还能按模型拆分。
这项功能把 Agent 名单与实际消耗放在同一处,方便安全和成本团队发现突然增加的调用。不过官方公告没有把 Token 用量等同于业务价值,也没有说明所有 Agent 平台都已覆盖。
社区热议
同一个本地模型换了推理引擎就变笨,问题可能不在权重
Level1Techs 的实践帖指出,同一套模型权重在不同推理引擎、注意力实现、量化方式和 KV cache 设置下,可能给出不同结果,甚至影响工具调用。帖子用 Qwen3.6 的 BF16、不同 attention backend 与 KV cache 量化做了对照。
这不是一套覆盖所有模型的学术评测,但提醒本地部署者不要只看权重名称。上线前应固定聊天模板、采样参数和推理后端,并用真实任务复测,尤其要检查工具调用和长上下文。
一个开源桌面办公室把 12 种命令行 Agent 放进同一团队
Munder Difflin 用办公室界面包装 Claude Code、Codex、Gemini、Kimi、Qwen 等 12 种命令行 Agent,让它们分工、传消息并查看彼此状态。个人版免费且采用 MIT 许可证,主要工作与密钥留在本机。
它不替用户购买模型额度,而是复用已有订阅或 API 凭据。云端和组织功能另行收费,团队克隆消息提供端到端加密。办公室动画是确定性界面,不会额外消耗模型 Token。
用户怀疑 Claude Code 在测试较低思考强度,但目前只有截图和社区观察
一名用户在 X 发布截图,称 Claude Code 可能把部分请求分到较低 effort,并把它解释为 A/B 测试。HN 讨论随后升温,一些用户把近期体验变化与这项说法联系起来。
这不是 Anthropic 的正式公告,也没有公开实验范围、分组方法或稳定版本说明。截图只能证明有人看到了某个界面或响应,不能证明所有账号、模型或会话都被降档。
电影从业者一边教 AI 做专业工作,一边担心这些系统取代岗位
《卫报》采访参与 AI 数据标注和训练的好莱坞创作者。报道说,一些编剧、剪辑等专业人员因行业工作减少而接下训练项目,把自己的判断拆成示例、标签和反馈。
受访者担心,短期收入正在帮助系统学习自己的职业技能。报道呈现的是从业者经历与劳动力矛盾,不是对模型已经能完整替代某个岗位的证明。
此前漏报
阿里开放 Qwen3.8 旗舰权重,并推出可在消费级设备运行的 27B 多模态模型
阿里发布 Qwen3.8-27B 开放权重模型,原生支持文字和图片,采用 Apache-2.0,标准上下文 26.2 万 Token,并可扩展到 100 万。官方说,量化后可以在消费级硬件和笔记本上运行。
同一公告还开放 Qwen3.8-2.4T-A95B 旗舰权重,模型总参数 2.4 万亿、每次激活 950 亿,也支持最高 100 万上下文。性能对比来自阿里自己的测试,部署前仍要用真实任务复核。
OpenAI 把 GPT-5.6 Sol 的三个月促销价降到输入 4 美元、输出 20 美元
OpenAI 在 8 月 21 日更新 GPT-5.6 公告,把 Sol 的 API 和按 Token 计费额度价格下调三个月。标准短上下文每 100 万 Token 的输入价从 5 美元降到 4 美元,缓存输入从 0.50 美元降到 0.40 美元,输出从 30 美元降到 20 美元。
官方费率表说促销至少持续到 2026 年 11 月 21 日,并适用于符合条件的 ChatGPT Work 与 Codex 按 Token 用量;Plus、Pro、Business 等订阅价格和原有用量限制不变。
GitHub 趋势
x64dbg-mcp-server 让 AI 助手通过 MCP 控制 Windows 调试器
这个 Zig 项目把 x64dbg 的调试能力通过 MCP 和 HTTP 暴露给 AI 助手,可用于查看进程、断点与调试状态。仓库在本期窗口内首次公开,核验时有 203 stars。
solo-skills 整理 15 个可复用 Agent 技能,面向个人业务自动化
solo-skills 收录 15 个可复用技能,把个人经营中的重复流程拆成 Agent 可执行的说明与模板。仓库在本期窗口内首次公开,核验时有 114 stars。
ClipFactory 把主题、模板和自有素材自动拼成竖屏短视频
ClipFactory 用 AI 生成脚本、旁白、镜头和字幕,再通过 FFmpeg 把用户自己的 B-roll 拼成竖屏视频。仓库在本期窗口内首次公开,核验时有 56 stars,采用 Elastic-2.0 源码可用许可证。
今天最值得注意的不是某个模型又多了几分,而是 AI 产品开始进入交接和成本重算阶段。InstantDB 用户要面对托管服务退出,英伟达客户要重新估算整机价格,OpenAI 又用促销降低推理成本。团队现在更需要把迁移出口、价格有效期和可复现配置写进日常工程,而不是只看发布标题。