OpenAI 预览 Ultrafast,输出速度最高提升至 Standard 的 14 倍
这项限量预览由 Cerebras 基础设施驱动,最高可达每秒 750 个输出 token;它把等待时间从模型选择问题变成可直接优化的交互变量。
Google 发布 Gemini 3.7 Flash,继续压低快速推理门槛
新模型进入 Gemini API 官方目录,并在 Hacker News 获得 120 分;适合需要高吞吐、低等待的生产任务优先试跑。
本期栏目:头条 3 · 研究与论文 2 · 工具与产品 3 · Builder 观点 2 · 播客精华 1 · GitHub 趋势 3
阅读本期全文 →朱红为有刊日期,点击直达当期;方框为今天。