AI 日报 · 2026 年 9 月 16 日 · 星期三
AI BRIEF NOW
覆盖窗口(北京时间):2026-09-16 00:00 至 2026-09-17 00:00(不含结束时刻)。按北京时间自然日归期;迟到内容补回原日期,不作为今天的新消息。
最后内容更新:2026-10-03 21:28 · 第 1 版
暂无通过核验的当日内容,等待更新。
重要补录 · 近期发布
迟到的重要报道与官方发布,保留原文日期与已核实的事件日期;不计入当期新闻与事件统计。
原文 09.16 · 官方
NVIDIA Blog一手原文 09.16
NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1 并取得领先性能
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中,于 Qwen3-VL 上吞吐量最高达 GB300 NVL72 的 3.7 倍,于 DeepSeek-R1 上最高达 2.5 倍。
原文 09.16 · 官方
NVIDIA Blog一手原文 09.16
Emerald AI、Google 与 NVIDIA 发起 AI 能源管理联盟 AEMA,推动灵活 AI 数据中心
Emerald AI、Google 和 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态调节用电。
原文 09.16 · 官方
OpenAI News一手原文 09.16OpenAI 用 AI 重塑广告体验,推出 Sponsored Agents
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
原文 09.16 · 官方
OpenAI News一手原文 09.16OpenAI 如何将 AI 使用情况与业务价值挂钩
OpenAI 介绍如何用 ChatGPT Work 和 Codex 的分析功能,帮助团队了解 AI 使用量与支出、识别培训需求,并把 AI 采用情况与业务成果关联起来。
原文 09.16 · 官方
OpenAI News一手原文 09.16Hex 借助 GPT-6 Astra 将复杂分析转化为可视化报告
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,供员工直接分享。
原文 09.16 · 官方
Mistral AI一手原文 09.16
Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供模型支持
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)改由 Mistral 模型驱动,先面向法国和北美用户,英国和德国预计今年晚些时候跟进。Smart Window 可帮助理解复杂搜索、找回此前点击离开的重要内容,并基于浏览器标签页整理信息。双方称对话默认不保存在 Mozilla 服务器上,Mistral 等合作方同意零数据保留。
原文 09.16 · 媒体
Latent Space原文 09.16TypeSafe 发布 Jev 决策模型:比小型前沿 LLM 快 100 倍以上、便宜 200 倍以上
TypeSafe 发布 Jev,一个用 RLCD 训练、只做决策/分类/路由/打分的非自回归模型,官方称比小型前沿 LLM 快 100 倍以上、便宜 200 倍以上,输出 token 免费。
原文 09.16 · 官方
OpenAI News一手原文 09.16OpenAI 经济研究:员工如何用 AI 解锁新的工作方式
OpenAI 经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中的常规环节。
原文 09.16 · 官方
vLLM Releases一手原文 09.16
vLLM 发布 vllm-proto 0.2.0
vLLM 发布 vllm-proto 0.2.0(proto-v0.2.0),该 tag 已通过签名验证,并由 PR #56538 的 CI 在 fa2a26f 提交上验证通过。
原文 09.16 · 官方
NVIDIA Blog一手原文 09.16
曼彻斯特大学用 NVIDIA Earth-2 预测全英空气污染
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式模型 Earth-2 CorrDiff,用一年英国逐小时污染数据训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,在 Isambard-AI 单节点 8 块 GPU 上仅用两天完成训练。
原文 09.16 · 官方
NVIDIA Blog一手原文 09.16
Salesforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 构建
Salesforce 在 Dreamforce 上发布其首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练,训练语料来自近三十年企业 CRM 部署的专有合成数据集,覆盖制造、金融服务、医疗和旅游等 14+ 行业。
原文 09.16 · 媒体
Latent Space原文 09.16Good Start Labs 研究:游戏中学到的技能能否迁移到真实工作?
Good Start Labs 将 1830: The Game of Railroads and Robber Barons 作为训练环境训练了一个 30B 模型,结果显示只有多轮终端智能体设计提升了 Finance-Agent benchmark 表现,单轮问答设计则没有。
原文 09.16 · 官方
Google Research一手原文 09.16Google Research 提出 Retrieve-for-Train:用 RL 编译扩散检索器绕过推理瓶颈
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归的查询扇出,无需生成 CoT 推理 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调扇出语言模型,以集合级属性奖励评估整组结果,相关论文已被 ICML 2026 收录。
原文 09.16 · 官方
Google DeepMind一手原文 09.16Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking
Google DeepMind 发布两款实时对话模型 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,分别面向规模化低成本场景与高复杂度多步推理任务。
原文 09.16 · 官方
NVIDIA Blog一手原文 09.16
NVIDIA 发布 DSX 平台:固定电力预算下 token 吞吐提升 24%
NVIDIA 在 AI Infra Summit 上介绍其 DSX 平台,用于在固定电力预算内提升 AI 工厂的 token 吞吐。云厂商 Lambda 在 HGX B200 服务器上验证 DSX MaxLPS,用 19 个节点跑出与 16 节点满功耗相同的电力预算,集群 token 吞吐提升 24%,从约每秒 400 万 token 增至 500 万,每瓦性能提升 23%。
原文 09.16 · 官方
NVIDIA Blog一手原文 09.16
NVIDIA 在 AI Infra Summit 公布 Vera Rubin 与 DSX 平台能效进展
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 与 DSX 平台的多项能效进展,重点围绕每兆瓦 token 产出优化 AI 工厂。
原文 09.16 · 官方
Hugging Face Blog一手原文 09.16
IBM 研究提出 ALTK-Evolve 一致性指南,将智能体一致性差距减半
IBM 研究团队在 ALTK-Evolve 中新增一致性指南(consistency guidelines),基于 Consistency Analyzer 诊断智能体易翻转的决策点。