跳到正文
IT Home·· 2026-06-24AI 评分58

火山引擎发布豆包音频生成模型 1.0,支持多模态参考生成与长时音色一致性

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

火山引擎发布豆包音频生成模型 1.0(Doubao-Seed-Audio 1.0),支持把文本、音频任一模态作为输入端到端生成目标音频。该模型可在长时生成中保持多角色音色一致,并能在单条 Prompt 中编排角色对白、情绪语气、背景音乐与环境氛围。

来源:IT Home · ithome.com