跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 61–80 条 · 共 90 条
6月9日周二
6月8日周一
  1. Google DeepMind62

    Google DeepMind 在塞拉利昂开展 AI 学习效果随机对照试验

    Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,相当于八周内取得约 1.2 至 1.7 年的常规学习进度。

    推荐理由:Google DeepMind 在塞拉利昂的预注册随机对照试验给出了 AI 辅助教学的具体量化结果与使用行为数据。

6月5日周五
  1. Google Research60

    Google 在 Gemini Enterprise Agent Platform 上线 Agentic RAG

    Google 在 Gemini Enterprise Agent Platform 推出基于 Agentic RAG 的 Cross-Corpus Retrieval 公开预览版,通过 Orchestrator、Planner、Query Rewriter、Search Fanout 和 Sufficient Context Agent 等角色协作处理多源多跳查询。

    推荐理由:原文给出多智能体 RAG 的架构细节与跨语料评测数据,可据此判断复杂多跳查询的检索可靠性。

  2. Google Research71

    Google 研究用手机摄像头被动监测心脏健康

    Google Research 在 Nature 发表研究,提出 PHRM 系统,利用手机前置摄像头在面部解锁后的数秒内拍摄视频,通过深度学习在后台估算心率和静息心率。

    推荐理由:Google 用手机前摄在解锁后被动测心率,并公开最大规模手机视频数据集与预训练模型,可看 rPPG 的肤色公平性进展。

6月4日周四
  1. Google Research62

    Google 开源水文建模框架,支持机构自建 AI 洪水预报

    Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文建模框架,让各国气象与水文机构能用与 Google Flood Hub 相同的架构和相近训练数据训练 AI 洪水预报模型。

    推荐理由:Google 把驱动 Flood Hub 的水文模型架构与训练流程开源,读者可了解其预测窗口提升与本地化接入方式。

5月20日周三
5月19日周二
5月18日周一
  1. Google DeepMind62

    Google DeepMind 为 Project Genie 加入 Street View 真实场景生成能力

    Google DeepMind 在实验性原型 Project Genie 中上线 Street View 真实场景锚定能力,用户可选取美国境内地点并搭配风格与角色描述,生成以真实影像为起点的可交互世界,该能力由 Maps Imagery Grounding 驱动。

    推荐理由:原文给出 Genie 接入 Street View 真实影像后的世界生成方式与开放范围,读者可据此判断世界模型落地路径。

5月17日周日
  1. Google DeepMind65

    Google 将 SynthID 与 C2PA 内容验证扩展到搜索、Gemini 和 Chrome

    Google 宣布把内容透明度与验证工具扩展到 Search、Gemini、Chrome、Pixel 和 Cloud。SynthID 已为超过 1000 亿张图片和视频、6 万年音频加上水印,Gemini 应用中的 SynthID 验证已被使用 5000 万次,并将在未来几周进入 Search 和 Chrome。

    推荐理由:Google 把 SynthID 与 C2PA 验证铺到搜索、Gemini 和 Chrome,读者可了解内容溯源工具的实际覆盖范围。

5月16日周六
  1. Google DeepMind62

    WeatherNext 如何帮助美国国家飓风中心预测飓风 Melissa 登陆牙买加

    Google DeepMind 与 Google Research 开发的 AI 天气模型 WeatherNext 帮助美国国家飓风中心提前五天预测飓风 Melissa 将以五级强度登陆牙买加,置信度达 80%,三天前升至接近 100%。

    推荐理由:原文给出 WeatherNext 在飓风路径与强度预测上的实际表现,读者可了解 AI 天气模型在极端事件中的落地方式。

  2. Google DeepMind87

    Google DeepMind 发布 Gemini 3.5 Flash

    Google DeepMind 发布 Gemini 3.5 系列首个模型 3.5 Flash,主打智能体与编码能力,在 Terminal-Bench 2.1 取得 76.2%、GDPval-AA 1656 Elo、MCP Atlas 83.6%,CharXiv Reasoning 为 84.2%,输出速度是其他前沿模型的 4 倍。

    推荐理由:原文给出 3.5 Flash 在编码与智能体基准上的具体成绩和开放渠道,读者可据此判断速度与质量的取舍。

5月12日周二
5月6日周三
  1. Google DeepMind74

    Google DeepMind 回顾 AlphaEvolve 一年进展:从 TPU 设计到商业落地

    Google DeepMind 发布 AlphaEvolve 推出一年的影响汇总,这一由 Gemini 驱动的编码智能体已从试点成为 Google 基础设施的核心组件,用于优化下一代 TPU 设计并发现更高效的缓存替换策略。

    推荐理由:原文汇总了 AlphaEvolve 在芯片设计、电网优化和商业客户中的落地数据,可据此判断算法发现智能体的实际适用范围。

4月30日周四
  1. Google DeepMind62

    Google DeepMind 发布 AI co-clinician 医疗研究计划

    Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生临床监督下协助患者诊疗。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,医生更偏好其回答而非主流证据综合工具。

    推荐理由:原文给出AI co-clinician在临床证据问答与实时多模态远程问诊中的评测结果,读者可据此了解医疗AI当前能力边界与协作定位。

4月23日周四
4月22日周三
4月16日周四
  1. Google DeepMind65

    Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型

    Google DeepMind 发布 Gemini 3.1 Flash TTS,一款主打可控性与表现力的文本转语音模型,已在 Gemini API、Google AI Studio、Vertex AI 和 Google Vids 中开放预览。

    推荐理由:官方给出音频标签的细粒度控制方式和多语言覆盖范围,读者可据此判断语音生成在应用中的可控程度。