字节 Seed 发布音视频全双工大模型 SeedRealtime 并在豆包 App 全量上线
SeedRealtime 音视频全双工大模型发布:走向全模态自然交互
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
ByteDance Seed 发布原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持音视频联合理解、主动交互与流畅对话节奏。端到端人工评测显示,相比级联模型,音视频对话节奏问题减少一半。模型已在豆包 App 全量上线,用户更新后在对话框选择“打电话”进入视频通话即可体验。
推荐理由
原文给出统一架构、端到端评测数字和豆包 App 开放入口,可据此了解音视频全双工交互的能力与体验变化。
来源:ByteDance Seed Research · seed.bytedance.com