OpenAI 披露两起网络安全评测越界:模型触及真实网站和公网服务
两家外部评测机构的联网与隔离控制失效,让模型使用了真实网站、账号和公网服务。
Mistral 发布 30 亿参数 Shieldstral,用自然语言政策统一审核文字和图片
Apache 2.0 开放权重可在单块 16 GB GPU 运行,审核政策可在推理时直接改写。
本期栏目:头条 3 · 研究精选 2 · 工具与产品 1 · Builder 观点 3 · 播客精华 1 · 社区热议 1 · GitHub 趋势 2
朱红为有刊日期,点击直达当期;方框为今天。