AI 日报 · 2026 年 7 月 16 日 · 星期四
AI BRIEF NOW
覆盖窗口(北京时间):2026-07-16 00:00 至 2026-07-17 00:00(不含结束时刻)。按北京时间自然日归期;迟到内容补回原日期,不作为今天的新消息。
最后内容更新:2026-10-03 21:28 · 第 1 版
暂无通过核验的当日内容,等待更新。
重要补录 · 近期发布
迟到的重要报道与官方发布,保留原文日期与已核实的事件日期;不计入当期新闻与事件统计。
原文 07.16 · 官方
Hugging Face Blog一手原文 07.16
新模型来了,DharmaOCR 在巴西葡萄牙语 OCR 上仍保持优势
DharmaOCR 在葡萄牙语专项基准上得分 0.925,高于 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587。该模型通过葡萄牙语监督微调加 DPO 两阶段训练,将全部参数集中于巴西葡萄牙语,从而在提取质量和稳定性上保持优势。
原文 07.16 · 官方
Google DeepMind一手原文 07.16Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案
Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,一方面防止威胁行为者滥用其模型,另一方面让政府、科学家与生物安全专家借助 AI 应对疫情。过去 12 个月,双方已推进超过 15 项合作,覆盖预防、检测与响应三个环节,包括将 SynthID 水印技术适配到生物学领域,以及用智能体 AlphaEvolve 优化宏基因组测序数据分析算法。
原文 07.16 · 官方
Hugging Face Blog一手原文 07.16
Hugging Face 披露 7 月安全事件:入侵由自主 AI 智能体驱动
Hugging Face 披露本周检测到一起针对其部分生产基础设施的入侵,该攻击由一套自主 AI 智能体系统端到端驱动,通过数据集处理中的两条代码执行路径获得初始访问,随后提升权限、窃取云和集群凭证并在周末横向移动至多个内部集群。
原文 07.16 · 官方
Kimi 官方 Blog一手原文 07.16
Kimi 发布 PerceptionBench:评估多模态大模型原子视觉感知能力
Kimi 团队发布 PerceptionBench,从 42 个基准的前沿模型失败案例中归纳出 10 类原子感知能力,构建 3,000 道经核验的题目,每题仅考察单一感知能力、无需推理或外部知识。在 16 个前沿多模态大模型上,无一模型准确率超过 60%,感知相关幻觉平均表现最弱。该数据集与评测代码已开源。
原文 07.16 · 官方
Kimi 官方 Blog一手原文 07.16
Kimi 发布 2.8T 参数模型 Kimi K3
Kimi 发布迄今最强模型 Kimi K3,采用 Kimi Delta Attention 与 Attention Residuals 架构,参数规模 2.8T,原生支持视觉并具备 100 万 token 上下文窗口,官方称其为全球首个开放的 3T 级模型。
原文 07.16 · 官方
Google Research一手原文 07.16Google Research 揭示扩散模型创造力来源:score smoothing 机制
Google Research 在 ICLR 2026 论文中揭示,扩散模型的创造力源于神经网络训练中的 score smoothing:权重衰减等正则化使学到的 score function 变平滑,去噪过程因此在训练数据点之间插值,生成新样本而非简单记忆。研究用一维两点实验和两层 ReLU 网络验证,权重衰减越强插值区越明显,即使无显式正则化,梯度训练的隐式正则化也能产生同样效果。
原文 07.16 · 官方
Hugging Face Blog一手原文 07.16
模型路由并不简单:从分类问题到系统优化问题
在 AppWorld Test Challenge 的 417 个任务上,同一 CodeAct 智能体下 Claude Sonnet 4.6 总成本 79 美元(0.19 美元/任务),GPT-4.1 却达 155 美元(0.37 美元/任务),原因是缓存命中率拉低了 Sonnet 的实际输入成本。