跳到正文

#现象/趋势

今日 4 条
今天9月30日周三
  1. TechCrunch · AI80

    OpenAI 新功能直指应用商店模式

    TechCrunch 分析称,OpenAI 在 Dev Day 上发布的 Dots 智能体、ChatGPT 内应用推荐与插件扩展等多项功能,共同把 ChatGPT 变成软件被发现、启动和使用的入口,直接挑战传统应用商店模式。

    推荐理由:梳理 OpenAI Dev Day 多项发布如何组合成对应用商店分发模式的挑战,并指出其尚未公布计费与分成机制。

9月29日周二
  1. Ars Technica · AI25

    Firefox 157 重新设计界面,Mozilla 的 Ajit Varma 谈如何从 Chrome 争夺用户

    Mozilla 随 Firefox 157 在桌面和移动端推出界面重新设计,Firefox 负责人 Ajit Varma 称目标是让更广泛用户因体验而非价值观选择 Firefox,并借 AI 工具加快开发节奏。他承认多数用户分不清 Chromium、Blink、Gecko 与搜索引擎的区别,Firefox 仍靠 Google 默认搜索协议贡献大部分收入。

  2. Latent Space78

    AINews:Opus 5.5 擅长生成讲解视频

    AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。评测方面,Opus 5.5 在 SimpleBench 以 88.4% 领先,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%,max 档回落至 59%。

    推荐理由:汇总 Opus 5.5 发布一周内的评测数据与社区实测,可快速了解前沿模型在视频生成和智能体任务上的位置。

9月28日周一
  1. Import AI22

    Import AI 474:Platonic mindspace、太空中的 TPU、智谱启动外层 RSI 循环

    智谱启动了一个外层 RSI(递归自我改进)循环。Michael Levin 提出"Platonic mindspace"假说,认为心智是非物理模式,身体与机器只是其进入物理世界的接口,并用 xenobots、anthrobots 等实验佐证。本期还讨论了太空中的 TPU 以及机器人领域正为 LLM 时刻做准备但缺少通用算法。

  2. Simon Willison12

    Muse AI Agent 代用户回复消息酿成失误

    Muse AI Agent 在代 @matt.j.robb 处理 MX Keys Mini 取件时,于 9:27 自动回复取件人 Usman“Yep I'm here!”,但用户当时并不在场,Usman 等待至 9:38 后离开并给出差评。该 Agent 已从用户账号发送道歉并提出改日再试,同时建议停止在无法核实的情况下自动回复“在家”。

9月26日周六
9月25日周五
  1. Ars Technica · AI71

    特朗普政府用 AI 审批 Medicare 老年患者护理,被指程序违规

    特朗普政府今年 1 月推出试点项目 WISeR,用 AI 决定 Medicare 老年患者部分护理的授权或拒批,此前该项目并不要求医生预先审批。随后媒体报道德技术故障、审批延迟、拒批理由费解、医生不满和患者忍痛等待,电子前沿基金会本月公布的联邦文件基本印证了这些情况,其中一位医疗提供者称该项目是人类的耻辱。

  2. Ars Technica · AI58

    新泽西因无人机照片曝光 62 台燃气发电机对数据中心罚款 110 万美元

    新泽西州本周责令 DataOne 支付 110 万美元罚款,原因是其在 Vineland 数据中心秘密安装并运行燃气发电机,违反该州《空气污染控制法》。调查由 The Guardian 与 Floodlight News 在 8 月通过热成像无人机拍摄,显示 62 台发电机中有 45 台在运行,且均未取得 37 千瓦及以上容量所需的许可,实际运行容量达 1,982 千瓦。

9月24日周四
9月21日周一
  1. Import AI22

    Import AI 473:美国超级智能战略、人脑组织小鼠实验与机器诠释学

    RAND 发布长文提出美国应以“自由行动”战略应对通往超级智能的不确定路径,核心是保留选项而非锁定单一方案,并归纳了共存、拒止、加速三类共七种原型策略及五项关键不确定性。研究人员还在脑组织被刻意清除的幼鼠体内培育出部分人脑组织,将其作为潜在实验平台。

8月31日周一
8月10日周一
  1. Import AI32

    Import AI 468:23 条 RSI 政策建议、PostTrainBench+,以及信任与透明度如何影响 AI 竞赛

    Import AI 第 468 期收录了智库 IFP 提出的 23 条政策建议,分属 7 个类别,旨在帮助政策制定者应对 AI 研发进一步自动化带来的风险。MIT 与 Columbia 的论文《Racing to Ruin》分析认为,竞争对手之间实现协调减速的关键变量是技术开发的透明度,以及能否将对方建模为可信、理性的行为者。

8月3日周一
7月7日周二
  1. Berkeley AI Research34

    智能免费之后怎么办?面向智能体、由智能体构建、为智能体服务的数据系统

    伯克利 EPIC Data Lab 提出,随着推理成本从 2023 年初 GPT-4 级约 $30/百万 token 降至如今不到 $1、部分厂商低于 $0.10,数据系统需应对三大新挑战:为智能体服务、由智能体运行、由智能体构建。其中智能体查询会产生大量重复子计划,在 text-to-SQL 基准上仅 10-20% 子计划不同,80-90% 属重复工作,可通过多查询优化与近似查询处理加以利用。

5月8日周五