OmniTools 7月20日消息,字节跳动 Seed 团队正式发布音频创作模型 Seed Audio 1.0。该模型在统一框架下联合建模人声、音效与环境声,支持 100 毫秒级时间控制精度、单次约 2 分钟音频的延展生成,以及 20 余种语言的自然语音合成。 Seed Audio 1.0 已上线火山方舟体验中心。官方数据显示,多数应用场景下音频可用率超过 90%,多语言音频自然度主观评分(MOS)高于 4 分(满分 5 分)。