FireRedTeam 开源 DynamicPose:姿态序列驱动的人像动画框架
FireRedTeam 发布 DynamicPose,一个由人体姿态序列驱动的人像动画 image-to-video 框架,并同步开放预训练模型、pose server 与姿态对齐算法。
项目更新、模型与开源社区动态
FireRedTeam 发布 DynamicPose,一个由人体姿态序列驱动的人像动画 image-to-video 框架,并同步开放预训练模型、pose server 与姿态对齐算法。
FireRedTeam 发布开源项目 PhotoPoster,一个高保真两阶段姿态驱动图像生成框架,通过引入精修阶段显著提升 i2i 图像质量,并同步开源预训练模型和基于 FastAPI 的 pose server。团队计划两周内发布 ComfyUI 支持及配套的 i2v 项目 DynamicPose,后续还将开放推理代码、训练代码和数据处理流程。
FireRedTeam 发布一致性蒸馏方法 Target-Driven Distillation(TDD),通过目标时间步选择与解耦引导策略,让蒸馏后的 SDXL、SVD-xt 1.1 和 FLUX.1-dev 仅需 4-8 步即可生成高细节图像。
FireRedTeam 在 GitHub 上线 fireredteam.github.io 仓库,包含 css、demos、pics 等目录及 data.js、index.html 等文件。
FireRedTeam 在 GitHub 发布升级版可流式基础文本转语音系统 FireRedTTS-1S,并公开预训练 checkpoint 与推理代码。该版本新增 flow-matching 解码器,支持零样本语音克隆,参考音频建议 3 至 10 秒,合成音频采样率为 24000。官方声明该语音克隆能力仅限学术研究用途。