跳到正文

全部动态

今日 4 条
今天9月30日周三
  1. The Decoder78

    ElevenLabs 发布 Eleven v4 语音模型,并推出面向实时智能体的 Turbo 版本

    ElevenLabs 发布语音模型 Eleven v4,能更准确地遵循脚本中的情绪、停顿和音效标签,并在长内容制作中保持音色一致。新架构同时支撑 Turbo 版本,官方测试中约 150 毫秒开始输出语音,对比 Cartesia Sonic 3.6 的 262 毫秒和 OpenAI GPT-4o mini TTS 的 814 毫秒。

    推荐理由:Eleven v4 在语音一致性与实时延迟上的具体指标,可供做语音智能体和配音的团队比较选型。

9月29日周二
  1. Hugging Face Blog62

    NVIDIA 发布表格基础模型 Kumo Tabular,在四个基准排名第一

    NVIDIA 发布开源表格基础模型 Kumo Tabular,面向表格分类与回归,给定带标签的行即可在单次前向传播中预测新行标签,无需训练、调参和特征工程。模型提供 28M 到 215M 三种规模,仅用人工合成表格预训练,通过开源库 structured-data-models 运行,采用 OpenMDW-1.1 许可可商用。

    推荐理由:原文给出模型规模、训练数据来源与四个基准排名,可据此判断表格基础模型相对梯度提升树的工作流差异。

  2. Latent Space78

    AINews:Opus 5.5 擅长生成讲解视频

    AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。评测方面,Opus 5.5 在 SimpleBench 以 88.4% 领先,在 Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%,max 档回落至 59%。

    推荐理由:汇总 Opus 5.5 发布一周内的评测数据与社区实测,可快速了解前沿模型在视频生成和智能体任务上的位置。

  3. AWS Machine Learning Blog62

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:文章给出 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,读者可据此判断长任务智能体的成本与延迟取舍。

  4. Simon Willison80

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 发布新模型 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上、多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于 Sonnet 5。

    推荐理由:作者用鹈鹕骑车提示词实测新模型,并对比免费层能力,可看模型速度、成本与编码表现。

9月28日周一
  1. Hugging Face Blog72

    H 公司发布 Holo4 系列智能体模型,含 27B 稠密与 35B-A3B MoE 两个版本

    H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,均已在 H Models API 上线,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。

    推荐理由:Holo4 同时覆盖 GUI、代码、MCP 与 API 四种接口,并公开全部评测轨迹,便于对照其成本与能力取舍。

9月25日周五
9月3日周四