17 9月 星期四 2026 目录 中文 EN

每日 AI 新闻简报 · 报刊式排版

今日 AI 速览

最新模型与能力排行:追踪 30 款通用大模型的能力跑分、价格与擅长方向 →

🔥头条

端侧芯片 · 车规智能算力突破

比亚迪首款车规级 4nm 智驾芯片「璇玑 A3」实现规模化量产:全栈自研打通端到端大模型量产闭环

9 月 16 日,比亚迪董秘李黔在新能源汽车产业峰会上确认,中国首款车规级 4nm 智能驾驶芯片「璇玑 A3」已正式开启规模化量产,首批搭载于仰望与腾势新一代高端车型。璇玑 A3 芯片深度集成了比亚迪全栈自研的低功耗端侧神经处理单元(NPU),单颗芯片可提供 500 TOPS 稠密算力,并在功耗受限的车载环境中支持端到端多模态大模型的毫秒级环境感知与实时路径决策。李黔强调,比亚迪未来将持续在半导体与核心算力领域深化投入,这一突破标志着国内整车厂商在高阶智能驾驶核心计算芯片领域实现了完全自主可控。

点评:高阶车规级先进制程芯片向来由海外巨头垄断,比亚迪以 4nm 璇玑 A3 跑通量产,补齐了自研智驾算法与底层算力芯片闭环的关键拼图。

IT之家 / 证券时报 · 2026-09-16 IT之家报道
系统与编译器 · GPU 原生语言演进

英伟达官方推出 CUDA-Rust 原生支持:双轨架构重塑 GPU 高性能内核编程与显存安全

英伟达正式在官方开发者平台推出针对 CUDA 的 Rust 原生语言支持(CUDA-Rust)及全套工具链。英伟达指出,随着超万卡分布式大模型训练与超低时延推理对算子稳定性的要求达到物理极限,传统 C++ / CUDA 容易发生的显存悬垂指针、缓冲区越界和数据竞争已成为大规模集群崩溃的主要诱因。CUDA-Rust 创新设计了双轨架构:第一轨提供符合 Rust 惯用法的高级所有权与借用安全抽象,让开发者能够编写可严密验证的算子;第二轨提供无约束的底层内联 PTX 与内联汇编通道,满足极致算力压榨需求。目前该工具链已开源并支持主流 Linux 发行版与 Hopper/Blackwell 架构。

点评:内存安全从 CPU 系统软件延伸至 GPU 核心算子是异构计算的里程碑,CUDA-Rust 有望从根本机制上遏制万卡集群长跑中令人头疼的静默显存崩溃。

NVIDIA 官方博客 · 2026-09-16 NVIDIA 官方博客
语音大模型 · 边想边说全双工

阶跃星辰(StepFun)全量上线 StepAudio 3 语音大模型全家桶:边想边说架构与全双工实时交互就绪

阶跃星辰开放平台于 9 月 16 日正式全量上线新一代语音大模型矩阵 StepAudio 3 系列,包含实时交互 Realtime、语音识别 ASR、高品质语音合成 TTS、全音频内容生成 Gen 与音乐创作 Music 共五款模型。其中旗舰级的 StepAudio 3 Realtime 首次落地边想边说(Think-While-Speaking)前沿架构,将复杂意图理解的深层思维链置于后台异步流式处理,并在毫秒级延迟下并行输出口语应答,实现了真正拟真的人类级实时打断与自然接话能力。在国际权威评测 Artificial Analysis 语音对话动态排行榜中,StepAudio 3 Realtime 以 98.9% 的交互自然度评分跃居全球榜首。

点评:语音交互从对讲机式的单向等待转向全双工边想边说,StepAudio 3 展现了国内实验室在复杂多模态实时系统上的高水平工程演进。

阶跃星辰开放平台 / 界面新闻 · 2026-09-16 阶跃星辰开放平台

🛠️工具与工程

轻量架构 · 三元大模型突破

BitNet a4.8 突破 1.58 比特极限:三元大语言模型实现高效非对称量化与能耗骤降 78%

在 arXiv 最新公开的论文中,微软亚洲研究院与开源联合团队推出了新一代 1-bit / 三元大模型架构 BitNet a4.8。该研究彻底颠覆了以往对称量化必须牺牲深层泛化能力的固有假设,创新提出非对称权重量化编码与动态稀疏激活缩放机制。实验结果表明,在 70B 级超大参数规模下,BitNet a4.8 在常识推理、长上下文理解与代码生成评测中的困惑度表现完全比肩 FP16 浮点基线模型,而每 token 矩阵乘法的硬件计算能耗下降了 78%,内存占用大幅缩减。这项突破扫清了超大规模模型在边缘计算节点和高密度推理服务器上低成本常驻的算力障碍。

arXiv 论文 · 2026-09-16 arXiv 论文
企业智能体 · CRM 深度连接

Anthropic 推出 Salesforce in Claude Beta:直接打通企业 CRM 核心数据流与自动化销售工作流

Anthropic 官方宣布面向 Claude Team 与 Enterprise 订阅用户正式开放 Salesforce 原生连接器公测。基于开源的模型上下文协议(MCP),Claude 能够以受控的安全权限直接读取并实时更新企业 Salesforce 实例中的客户线索、商机进度、合同记录以及自定义数据对象。销售代表与分析师无需在多个复杂企业业务系统之间来回复制粘贴,只需在 Claude 对话窗口中使用自然语言即可指令智能体跨部门生成精准客户简报、分析销售漏斗异动、自动撰写跟进邮件并在 Salesforce 中更新状态,大幅降低了企业智能体进入核心经营系统的落地摩擦。

Claude 官方博客 · 2026-09-16 Claude 官方博客
端侧硬件 · 息屏常驻智能体

努比亚与字节跳动联合发布二代豆包手机 NaviX Ultra,京东方独供 AI 原生极低功耗屏幕

努比亚与字节跳动旗下豆包大模型团队联合发布第二代 AI 原生手机 NaviX Ultra,京东方(BOE)宣布为其独家供应全新定制的 AI 原生旗舰屏幕。该屏幕采用先进的超微功耗氧化物背板技术与像素级微区驱动架构,专为移动端 AI 智能体的全天候常驻运行进行底层定制。在手机处于锁屏或熄屏待机状态时,屏幕仅以微瓦级超低能耗维持局部状态显示,支撑豆包端侧智能体在后台静默处理跨应用日程整理、邮件意图解析和突发事件监控,有效化解了端侧常驻智能体引发的异常发热与电量快速衰减问题。

IT之家 / 京东方公告 · 2026-09-16 IT之家报道

🔬前沿研究与评测

数据库与系统 · 强化学习优化器

QoRL 开源:用 4B 参数轻量级模型生成查询计划,比 PostgreSQL 原生优化器快 81%

独立技术研究员 Rohan Bansal 正式开源了基于强化学习调优的轻量级数据库查询计划生成系统 QoRL。针对传统关系型数据库(如 PostgreSQL)在面对多表复杂 JOIN、高度倾斜数据分布和多层嵌套子查询时基于启发式成本估算容易陷入糟糕局部最优的顽疾,QoRL 训练了一个仅 4B 参数的轻量模型,将关系代数抽象语法树与表物理分布元数据作为输入直接预测执行计划。在包含 113 个高复杂度查询的标准基准测试集中,QoRL 输出的执行计划使端到端查询耗时相比 PostgreSQL 17 官方优化器平均降低了 81%,展现了小参数专精模型改造经典基础软件内核的巨大潜力。

Rohan Bansal 技术博客 · 2026-09-16 QoRL 项目博客
商业化与生态 · 算力经济与扩散鸿沟

智谱上调 2026 年 ARR 指引至 30 亿美元,Box CEO 纵论企业 AI 扩散鸿沟

国内大模型领头羊智谱在投资者交流会上正式将 2026 年末年度经常性收入(ARR)指引上调 25% 至 30 亿美元,披露 GLM-5 系列在金融与高端制造行业的商业化订单已超 10 亿元人民币,并详细公布了未来投入 300 亿元建设 10 万 P 超算集群的单位经济模型。与此同时,企业网盘巨头 Box 联合创始人兼 CEO Aaron Levie 在访谈中深刻分析了当前企业 AI 普及面临的“扩散鸿沟”:模型能力虽呈指数级爆发,但大部分企业仍受阻于落后的业务流程、分散的数据孤岛与僵化的安全合规架构,单纯依靠聊天式界面无法撬动万亿存量软件资产,行业必须转向以多智能体编排与工作流深度嵌入为核心的新交互形态。

智谱投资者交流 / YouTube 访谈 · 2026-09-16 · 2 处信源 智谱开放平台 YouTube 访谈

GitHub 趋势

theoephraim/awesome-cloudflare-selfhosted

精选一系列可完全托管在 Cloudflare 个人账户上的开源替代方案,基于 Workers、Pages 与 D1 零服务器成本替代主流商用 SaaS 工具。

saragordic/window-sweaters

专为 macOS 设计的趣味菜单栏原生工具,为桌面活动窗口穿上织物毛衣装饰边框,单日斩获逾 400 颗星标。

编辑点评:本期简报的核心主线是“AI 从纯云端生成全面渗透进底层系统、边缘芯片与企业业务主干”。从比亚迪首款 4nm 车规智驾芯片璇玑 A3 开启量产,到英伟达官方引入 CUDA-Rust 编译器以内存安全重构 GPU 内核,算力底座正向高可靠、端到端自主掌控跃迁。在模型与应用层面,阶跃星辰上线 StepAudio 3 展现边想边说的全双工多模态能力,Anthropic 借 Salesforce 集成让智能体深入企业 CRM 核心数据流,而轻量级数据库查询优化系统 QoRL 则印证了 4B 小模型取代复杂人工启发式算法的颠覆性潜力。整个技术生态正在从“比拼参数规模”转向“打通生产全流程与物理现实”的扎实落地阶段。