字节发布 Seed Audio 1.0 音频创作模型,支持精细时间控制与多语种生成
字节发布 Seed Audio 1.0 音频创作模型:支持精细时间控制,音色风格可控、长时稳定
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
字节跳动 Seed 发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,端到端完成影视级音频创作。该模型支持用一条 prompt 统一编排带情绪的对白、关键音效和环境声并按时间线控制进场,可结合文本与参考音频输入,在长音频和多次延长场景下保持角色音色一致,并支持 20+ 语种生成。
来源:IT Home · ithome.com