跳到正文
  1. Anthropic News62

    Anthropic 推出 Cyber Mission,启动关键基础设施防御计划与 OSS Scanner

    据官方原文,Anthropic 推出长期网络安全计划 Anthropic Cyber Mission,先从关键基础设施和开源软件两个方向支持防御方。

    推荐理由:官方给出关键基础设施与开源两条防线的具体项目、合作方和免费扫描入口,可据此判断防御侧工具的实际覆盖范围。

  1. NVIDIA Blog78

    NVIDIA 与 Microsoft 发布 RTX Spark 笔记本及 Windows 版 DGX Station

    据 NVIDIA 官方原文,NVIDIA 与 Microsoft 在旧金山 Windows AI 活动上宣布为 AI 智能体共同设计 Windows PC 软硬件,Microsoft 宣布 OS 级智能体运行基础设施 MXC 正式可用。

    推荐理由:原文给出 RTX Spark 与 DGX Station for Windows 的规格和上市时间,读者可据此判断本地跑大模型与常驻智能体的硬件门槛。

  1. Mistral AI78

    Mistral 发布 Mistral Large 4 公开预览

    Mistral 官方发布 Mistral Large 4 公开预览,称其为 1 万亿参数、49B 激活参数的原生多模态模型,可在 Mistral Studio 试用预览 API,权重将于本月底放出。

    推荐理由:官方给出 1 万亿参数、49B 激活的开放权重路线与多模态、智能体编码基准,可据此判断开源前沿模型的当前水位。

  1. Hugging Face Blog60

    Ai2 开源 AstaBrief 8B 科学报告生成模型

    Ai2 开源 AstaBrief 8B,一个把研究问题和检索到的文献片段转成带引用报告的模型,基于 Qwen3-8B 训练,已作为 Asta 的 Fast 模式上线。

    推荐理由:原文给出了训练数据构造与引用过滤的具体做法,读者可据此判断小模型做科学报告生成的可行路径。

  2. Google Research62

    Google 发布基于 TEE 的联邦学习系统,Gboard 已采用

    Google 宣布下一代联邦学习系统,利用可信执行环境(TEE)为数据匿名化提供可验证、可审计的保证,Gboard 已采用该系统并上线英语和日语下一词预测模型。

    推荐理由:原文给出 TEE 联邦学习系统的四个运行环节与 Gboard 落地数据,读者可据此理解可验证隐私训练的系统设计。

  3. Exa Semantic Discovery82

    Anthropic 发布 Claude Sonnet 5.5,称更快更便宜

    Anthropic 发布 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5,称其输出速度比 Claude Sonnet 5 快 30% 以上,多数任务成本最多降低 30%。

    推荐理由:原文给出 Sonnet 5.5 的速度、成本与 Terminal-Bench 4.0 分数变化,可对照 Sonnet 5 判断日常任务的性价比。

  4. NVIDIA Blog62

    NVIDIA DGX Spark 推出 64GB 版本,支持双机集群扩展本地 AI

    NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,10 月 23 日上市,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 和完整 NVIDIA AI 软件栈,支持最高 1000 亿参数模型在设备上运行。

    推荐理由:原文给出 64GB 新配置的定价、上市时间和双机集群方式,读者可据此判断本地跑百亿参数模型的成本与扩展路径。

  5. xAI API 官方发布62

    xAI 上线 Grok 4.20 与 Grok 4.20 Multi-agent

    xAI 发布 Grok 4.20 和 Grok 4.20 Multi-agent,两款模型已在 API 上线。官方表示 Grok 4.20 Multi-agent 的更多细节可查阅文档。

    推荐理由:xAI 上线 Grok 4.20 与多智能体版本,读者可据此了解新模型在 API 侧的上线情况。

  6. xAI API 官方发布60

    xAI 发布 Grok Build 测试版

    xAI 发布 Grok Build 测试版,支持交互式 TUI、在脚本中无头运行,以及通过 Agent Client Protocol 构建应用和编排器。安装命令为 curl -fsSL https://x.ai/cli/install.sh | bash,更多细节见 Grok Build 文档。

    推荐理由:官方发布 Grok Build 测试版,给出交互式 TUI、无头脚本和 Agent Client Protocol 三种接入方式,便于判断其适用场景。

  7. xAI API 官方发布60

    xAI 发布 Context Compaction API 与 WebSocket Responses API 模式

    xAI 上线 Context Compaction API,可将长对话压缩为更短的上下文并在后续请求中复用,以降低成本、加快首 token 时间并改善长智能体循环中的回答质量。同时推出 WebSocket Responses API 模式,通过单条长连接驱动 Responses API,降低工具密集型智能体工作负载的端到端延迟。

    推荐理由:原文给出上下文压缩与 WebSocket 两种接口能力,读者可据此判断长对话智能体在成本与延迟上的取舍。

  8. xAI API 官方发布67

    xAI 在 API 上线 Grok 4.5,面向编码与智能体任务

    xAI 在 API 上线 Grok 4.5,定位为面向编码、智能体任务和知识工作的模型。定价为每 100 万输入 token 2 美元、每 100 万输出 token 6 美元,推理强度可配置为 low、medium 或 high,默认 high。

    推荐理由:原文给出 Grok 4.5 的 API 定价与可调推理强度,读者可据此判断接入成本与配置方式。

  9. xAI API 官方发布62

    xAI 发布 Grok Bot 持久云电脑 AI 队友

    xAI 发布 Grok Bot,定位为在持久云电脑上工作的 AI 队友,具备消息、审批、连接器和例行任务功能。官方同时提供了 Grok Bot 概览和入门文档入口。

    推荐理由:原文给出 Grok Bot 的持久云电脑与审批、连接器等能力,读者可据此判断它面向哪些团队协作场景。

  10. xAI API 官方发布71

    xAI 在 API 上线 Grok 4.6

    xAI 在 API 上线 Grok 4.6,定位面向编码、智能体任务和知识工作的前沿模型,支持 500k 上下文窗口、文本与图像输入、纯文本输出且无输出长度限制。

    推荐理由:原文给出 Grok 4.6 的上下文窗口、输入输出形态与分档定价,便于开发者评估接入成本。

  11. xAI API 官方发布72

    xAI 在 API 上线 Grok 4.7

    xAI 在 API 上线 Grok 4.7,定位面向编码、智能体任务和知识工作的前沿模型,模型名为 grok-4.7。它支持 500k 上下文窗口、文本与图像输入但仅输出文本,且无文本输出上限;200k prompt token 以内定价为每 1M token 输入 2 美元、缓存输入 0.5 美元、输出 6 美元,超出后分别为 4、1、12 美元。

    推荐理由:原文给出 Grok 4.7 的上下文窗口、定价分档与推理档位,读者可据此判断接入成本与适用场景。

  12. NVIDIA Blog62

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并面向 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户开放。

    推荐理由:原文给出 Astra Ultrafast 在 Blackwell 上的加速幅度与开放入口,读者可据此判断它对编码智能体循环的实际影响。

  13. AWS Machine Learning Blog60

    用 Amazon Bedrock AgentCore 构建事件驱动的 ambient agent

    AWS 发布参考实现,演示如何用 Amazon Bedrock AgentCore Runtime 构建 ambient agent:Amazon S3 上传或定时事件触发后自动创建任务,智能体在 AgentCore Runtime 的隔离容器中运行,需要人工介入时通过单个 ask_human 工具暂停并等待回复。

    推荐理由:原文给出事件驱动智能体从信号到人工审批的完整参考实现,读者可据此评估自家文档与告警流程的改造路径。

  1. Hugging Face Blog62

    AI2 发布 Olmo-core 3:面向大型 MoE 的开源可扩展训练框架

    AI2 发布 Olmo-core 3,这是其大模型开发框架的一次重大升级,核心是重新设计的开源 MoE 训练系统,目标是把 MoE 训练扩展到万亿参数级别并保持计算效率。

    推荐理由:原文给出 MoE 训练栈的吞吐与显存实测数据,读者可据此判断万亿参数 MoE 训练的工程门槛变化。

  2. Exa Semantic Discovery78

    OpenAI 发布常驻 AI 智能体 Dots,接入 4000 多个应用

    OpenAI 在 9 月 29 日旧金山 DevDay 上发布 Dots,一类可常驻运行的 AI 智能体,由 GPT-6 Astra 驱动,通过插件生态连接 4000 多个应用,并可在 ChatGPT、Slack、Microsoft Teams 和语音中调用。

    推荐理由:原文交代了 Dots 的常驻智能体形态、接入应用规模与权限控制设计,可据此判断自主智能体的落地边界。

  3. Google DeepMind82

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展至开发者、企业和消费者。

    推荐理由:原文给出 Gemini 4 Argon 在编码、企业知识工作与网络安全防御上的基准表现和分阶段开放方式,读者可据此判断前沿模型的能力边界与获取节奏。