228月星期六2026目录中文EN
Daily AI Digest

今日 AI 速览

模型速查 · 每日核对今天该用哪个模型?查看 30 款通用模型的能力、价格、上线日期与擅长方向打开最新榜单 →

头条


DEEPSEEK · V4 FLASH VISION EXP · 多模态 API

DeepSeek 给 V4 Flash 加上“看图”能力,图片现在能直接进入三套 API

DeepSeek 上线实验版 V4-Flash-Vision-Exp。它保留 V4 Flash 的文字、推理和 Agent 能力,同时可以读取图片。官方称,它在多模态 Agent 测试中的表现已经接近 Claude Opus 4.8,但这组对比由 DeepSeek 自己发布,仍需要独立复测。

开发者可以把文字和图片一起交给 Chat Completions、Messages 或 Responses API。图片可用 base64、外部网址或 Files API 提交,每张最多折算 384 个 Token,并按 V4 Flash 的价格计费。新的 Files API 免费,图片上传一次后可以用 file_id 重复调用,DeepSeek Harness 0.1.1 也已支持该模型。

点评:做截图理解或视觉 Agent 的团队可以开始小范围实测,但先用自己的任务核对质量,也要限制模型能访问的外部图片网址和工具权限。

DeepSeek · 8 月 21 日主窗口 · 2 源同报
ANTHROPIC · CLAUDE MYTHOS 5 · 网络防守

Claude Mythos 5 开始替企业查代码漏洞,Anthropic 再拿出 3500 万美元帮助开源项目

Anthropic 把 Claude Mythos 5 接入 Claude Security 公测。Claude Enterprise 用户可以让它扫描自己有权检查的代码仓库,返回漏洞分类、可信度、严重程度和修复建议。扫描按现有套餐的标准 Token 用量计费,不另收插件费;模型不会直接开放给用户,任何补丁仍要由人审核批准。

Anthropic 还在把 Mythos 5 接入合作伙伴的安全产品,并计划扩大 Cyber Verification Program,让通过审核的防守团队减少不必要的安全拦截。新的 Defender Advantage Fund 将提供 3500 万美元 Claude 额度,支持开源项目修复正在利用的漏洞、自动化扫描和更系统的安全改造。

点评:企业安全团队可以先从只读扫描和人工批准补丁开始;开源维护者若缺人手,也值得关注基金申请,但不要把厂商模型输出当成最终安全结论。

Anthropic · 8 月 21 日 · 2 源同报

工具与产品


CLAUDE CODE · V2.1.239 · 计费与会话修复

Claude Code 2.1.239 修掉代理环境重复计费,并补强跨机器会话

Claude Code 2.1.239 修复了一个会让费用翻倍的问题:某些代理服务器会删掉 Bedrock 流式响应的 Content-Type,客户端随后把每一轮再用非流式方式重跑。成本估算现在也会算入美国境内推理工作区的 1.1 倍附加费,并在月度额度耗尽时显示会话或每周额度的重置时间。

新版本还修复被删除工作目录、长对话标题、云端计划模式和临时 5xx 后 MCP 重连等问题。Windows 现在也支持跨会话 SendMessage 和 ListAgents;移动端上传到远程会话的图片会带上保存路径,方便 Agent 把图片复制进产物。

Anthropic GitHub · 8 月 21 日 12:54 美西时间
CLAUDE ACADEMY · 免费课程 · 官方学习站

Anthropic 推出 Claude Academy,把课程、教程和团队使用案例放到一个免费站点

Claude Academy 面向第一次接触 AI 的个人、刚开始用 Claude 的用户和准备在团队里推广 Claude 的企业。站内提供 AI Fluency、入门路径、教程和使用案例,内容由 Anthropic 官方维护,可以按主题或产品继续学习。

它解决的是“会聊天但不知道怎样稳定工作”的学习缺口。团队可以把官方课程当共同起点,再把自己的数据权限、审核流程和任务模板补进去。

Anthropic · 8 月 20 日 20:56 美西时间

社区热议


ANNA'S ARCHIVE · 实体书扫描争议 · 517 HN POINTS

训练 AI 的实体书被拆开扫描后销毁,社区开始担心公共知识只剩企业副本

Anna's Archive 称,多家 AI 公司通过中间商大量购买二手书,把书拆开扫描后销毁,以获得 2022 年以前、没有被机器生成内容污染的训练材料。文章把 Anthropic 的 Project Panama 作为已公开案例,并呼吁志愿者优先保存稀有书和易丢失资料。

这是一篇立场鲜明的影子图书馆文章。购书、拆书扫描和销毁在 Anthropic 版权诉讼材料中已有记录,但文章关于企业动机、规模外推和“知识垄断”的判断不能自动当作已证实事实。HN 的高热讨论集中在训练需求、文献保存和版权边界之间的冲突。

Hacker News · 8 月 20 日 19:38 美西时间 · 核验时 517 HN points
AI 文风疲劳 · 工作文档 · 252 HN POINTS

有人开始对 AI 味文档“自动失焦”,像看网页广告一样直接跳过

开发者 Rafal Cymerys 说,他读到明显由 AI 低成本生成的设计文档、营销方案和需求说明时,会下意识忽略内容。问题不只是几个常见词,而是每个小细节都被包装成突破、简单事情被写成长篇推理,读者最后还要来回追问。

他把这种反应称为 AI-blind,类似人们对网页广告形成的 banner blindness。这是个人观察,不是用户研究,但它提醒团队:生成更多文字不等于传递更多信息,提交文档的人仍要删掉空话并承担判断。

Hacker News · 8 月 21 日 04:48 美西时间 · 核验时 252 HN points
自托管 AGENT 工厂 · 隔离硬件 · 77 HN POINTS

一台隔离旧电脑从一句话建仓库、跑测试、配数据库并部署 HTTPS 应用

Jake Saunders 用独立家用电脑搭了一个 Agent 软件工厂。系统通过 Hermes 调用 Codex,配合 Forgejo、CI runner、Coolify、Postgres 和内部域名,从一条提示完成建仓库、写应用与测试、跑通 CI、准备数据库并上线 HTTPS 服务。

他的主要安全措施不是相信模型,而是把 Agent 放在单独硬件和没有公网入口的网络里,最坏情况只是重装机器。它仍然依赖外部推理、Tailscale、DNS 和证书服务,所以作者明确称为“几乎自托管”,也没有把这篇记录写成可直接照抄的完整教程。

Hacker News · 8 月 21 日 09:28 美西时间 · 核验时 77 HN points

Builder 观点


OpenAI Codex 产品负责人 Thibault Sottiaux 说明,Codex 没有悄悄调整正常订阅的用量上限。受影响用户中不少人在用 sub2api,把个人订阅转成 API 流量后再多人共享,这类行为会触发反欺诈;通过官方客户端或支持 Sign in with ChatGPT 的 Pi、OpenCode 等开源客户端使用订阅则没有问题。他还展示 GPT-Image-2 已能在 ChatGPT 和 API 里生成透明背景图片。

用量说明 →透明图片 →

Box CEO Aaron Levie 认为,应用型 AI 公司在掌握足够多同类任务和业务细节后,可以用后训练同时降低成本并提高准确率。通过奖励模型更省 Token 的工具调用和推理路径,团队能在效果相近时减少推理开销;但任务量不够大、通用模型已经够用时,没有必要专门训练。

在 X 查看原帖 →

GitHub 趋势


GITHUB TRENDING · SALESFORCE SF-SKILLS 1.41.0

Salesforce 一次加入 26 个 Agent 技能,并更新 11 个旧技能

sf-skills 是 Salesforce 为 Agentforce Vibes 和其他 AI 工具维护的应用开发技能库。1.41.0 在窗口内加入 26 个技能并更新 11 个技能,核验时有 892 stars,采用 Apache-2.0。

Agent skills · 892 stars 核验快照 · Apache-2.0
GITHUB TRENDING · FASTVIDEO · MINIMAX H3

FastVideo 为 MiniMax H3 加入少步生成示例,并压缩显存与解码开销

FastVideo 是视频生成推理和后训练框架。窗口内提交加入 MiniMax FastH3 Preview 的少步生成路径,优化 H3 的文字编码器显存和 VAE 解码;核验时有 4,022 stars,采用 Apache-2.0。

Python · 4,022 stars 核验快照 · Apache-2.0
GITHUB TRENDING · GOOGLE ADK SAMPLES · VIRTUAL TRY-ON

Google ADK Samples 新增零售虚拟试穿技能

Google 的 ADK 示例库收录用 Agent Development Kit 构建的示例 Agent。窗口内提交新增 retail/virtual-tryon 技能,给零售场景提供虚拟试穿的实现参考;核验时有 10,202 stars,采用 Apache-2.0。

Python · 10,202 stars 核验快照 · Apache-2.0
编辑点评

今天的主线是把更强模型放进受约束的真实流程。DeepSeek 用 Files API 降低图片重复传输,Anthropic 不直接开放 Mythos 5,而是通过代码扫描、合作伙伴工具和人工批准输出防守结果;社区自托管实践也把隔离硬件放在“相信 Agent”之前。模型越能行动,入口、权限、计费和复核就越要一起设计。