跳到正文

ByteDance Seed Research

seed.bytedance.com · 网站与博客

当前显示全部 AI 相关新闻
切换来源
全部网站与博客新闻IT Home8664 条Simon Willison353 条OpenAI News317 条TechCrunch · AI267 条The Decoder251 条Hugging Face Blog151 条The Verge · AI144 条Claude Blog135 条elsewhere articles110 条Google Research108 条OpenRouter Announcements103 条Mistral AI88 条Tomer Tunguz81 条Databricks Blog76 条Sierra Blog67 条Anthropic Newsroom65 条Gary Marcus64 条Claude Platform release notes62 条Runway News62 条LMSYS Blog60 条Google DeepMind58 条a16z News49 条LangChain Blog48 条Suno Blog48 条ByteByteGo46 条NVIDIA Blog46 条Apple Machine Learning Research43 条Google Blog: AI41 条Google Developers Blog35 条Cursor Blog33 条Microsoft AI News32 条Linear Now30 条AWS Machine Learning Blog29 条Google Cloud: Databases28 条Dwarkesh Patel27 条Ars Technica · AI26 条Nathan Lambert: Interconnects25 条Latent Space24 条DeepSeek API updates23 条Sakana AI Blog23 条Anthropic Research21 条Import AI21 条AI as Normal Technology20 条MIT Technology Review · AI16 条GitHub Blog · AI & ML12 条Meta Engineering11 条Berkeley AI Research10 条Microsoft Research10 条Black Forest Labs Blog8 条ByteDance Seed Papers8 条ElevenLabs Blog8 条Gemini API 更新日志8 条Manus Blog8 条MarkTechPost8 条MiniMax Blog8 条Qwen Blog8 条Together AI Blog8 条Every latest articles6 条ByteDance Seed Research5 条xAI:News5 条Thinking Machines Lab Blog4 条CMU Machine Learning Blog1 条Sam Altman Blog1 条MarkTechPost · 历史来源106 条xAI News · 历史来源73 条Artificial Intelligence News · 历史来源44 条Claude YouTube · 历史来源41 条Ars Technica: AI · 历史来源18 条GitHub Blog · 历史来源17 条Lilian Weng's Log · 历史来源2 条
5 条AI 相关新闻 · 最新在前
8月5日周三
  1. ByteDance Seed Research68

    字节 Seed 发布音视频全双工大模型 SeedRealtime 并在豆包 App 全量上线

    ByteDance Seed 发布原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持音视频联合理解、主动交互与流畅对话节奏。端到端人工评测显示,相比级联模型,音视频对话节奏问题减少一半。模型已在豆包 App 全量上线,用户更新后在对话框选择“打电话”进入视频通话即可体验。

    推荐理由:原文给出统一架构、端到端评测数字和豆包 App 开放入口,可据此了解音视频全双工交互的能力与体验变化。

7月31日周五
  1. ByteDance Seed Research73

    字节 Seed 发布视频生成模型 Seedance 2.5

    ByteDance Seed 正式发布视频生成模型 Seedance 2.5,延续 Seedance 2.0 的多模态音视频联合生成架构,单次生成时长从 15 秒提升至 30 秒并支持多轮延长,可生成数分钟连贯内容。

    推荐理由:官方公布单次生成 30 秒、30 张图参考和时间戳编辑等具体能力变化与上线入口,读者可据此评估视频创作工作流。

7月20日周一
  1. ByteDance Seed Research65

    字节 Seed 发布音频创作模型 Seed Audio 1.0,统一生成人声、音效和环境声

    字节 Seed 发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,端到端生成完整声音场景。模型支持 100ms 间隔的时间控制、零样本音色生成、单次约 2 分钟的延展生成,覆盖 20+ 语种;评测显示多数场景音频可用率达 90% 以上,多语种自然度 MOS 大部分超过 4 分。模型已在火山方舟体验中心上线。

    推荐理由:官方介绍统一框架下联合建模多种音频要素的思路,并给出时间控制精度、语种覆盖和评测数字,可用于了解音频创作模型的能力边界。

7月8日周三
  1. ByteDance Seed Research62

    字节跳动 Seed 发布 Seedream 5.0 Pro 图像创作模型

    字节跳动 Seed 发布多模态图像创作模型 Seedream 5.0 Pro,主打复杂信息可视化、交互式精准编辑、真实影像质感与原生多语种生成四大能力。模型已上线火山方舟体验中心,并将陆续在豆包、即梦上线,项目主页见 https://seed.bytedance.com/seedream5_0_pro。

    推荐理由:官方介绍给出四大能力方向和具体生成案例,读者可以判断它在专业设计场景中的可用性。

7月7日周二
  1. ByteDance Seed Research59

    字节跳动 Seed 发布 EdgeBench:衡量真实世界环境学习,发现新 Scaling Law

    字节跳动 Seed 发布超长程评测集 EdgeBench,包含 134 个真实任务,覆盖六大能力领域,每个任务支持 Agent 连续工作 12 小时以上。基于约 38000 小时环境交互记录,研究发现 Agent 环境学习表现遵循 log-sigmoid 曲线,平均拟合精度 R²=0.998,前沿模型的学习速度接近每三个月翻一倍。