跳到正文
原文
ByteDance Seed 官方发布·精选AI 评分62

字节 Seed 发布 Seed Audio 1.0 音频创作模型

From Speech to Audio Creation | Introducing the Seed Audio 1.0 Audio Creation Model

AI 导读

字节 Seed 发布 Seed Audio 1.0,这是一个在统一框架内生成语音、音效、环境音等场景级音频元素的音频创作模型,现已通过 BytePlus 开放使用。模型支持提示词级对话时间控制,精度为 100 ms 间隔,单次可生成最长两分钟音频并支持续写,覆盖中文、英语、日语等 20 多种语言。评测显示多数场景可用音频率超过 90%,多语言自然度 MOS 多数高于 4.0。

推荐理由

官方给出统一框架下的场景级音频生成能力与评测数据,可据此判断语音、音效与环境音一体化创作的实际可用度。

来源:ByteDance Seed 官方发布 · seed.bytedance.com