跳到正文

开发者平台

项目更新、模型与开源社区动态

当前显示全部 AI 相关新闻
按账号或来源筛选(5)
1,080 条AI 相关新闻 · 最新在前
5月14日周四
5月13日周三
5月12日周二
5月9日周六
5月8日周五
5月7日周四
5月6日周三
5月5日周二
4月28日周二
4月20日周一
4月17日周五
4月7日周二
4月2日周四
3月3日周二
2月28日周六
2月12日周四
2月11日周三
2月7日周六
10月27日周一
9月28日周日
9月9日周二
9月2日周二
  1. FireRedTeam GitHub 新仓库59

    FireRedTeam 开源 FireRedTTS-2 长对话语音生成模型

    FireRedTeam 开源 FireRedTTS-2,面向播客和聊天机器人的长对话流式 TTS,支持 3 分钟、4 说话人对话生成。支持中英日韩法德俄七种语言和零样本音色克隆,基于 12.5Hz 流式语音 tokenizer 与双 Transformer 架构,L20 GPU 上首包延迟低至 140ms,bf16 推理将显存占用从 14GB 降至 9GB,并已发布微调代码与教程。

3月24日周一
  1. FireRedTeam GitHub 新仓库35

    FireRedTeam 开源 CQ-DINO:面向超大词表目标检测的类别查询框架

    FireRedTeam 开源 CQ-DINO,一个基于类别查询的目标检测框架,用于超大词表目标检测,论文已被 NeurIPS 2025 收录。该方法通过类别查询缓解梯度稀释问题,支持 V3Det 与 COCO 2017 数据集,推荐使用 8 张 A100 GPU、CUDA 12.1 环境训练,并提供 Swin-B/L 等预训练权重与类别嵌入下载。

2月11日周二
  1. FireRedTeam GitHub 新仓库36

    小红书开源 Single Trajectory Distillation(STD):加速图像与视频风格迁移

    小红书与上海科技大学提出 Single Trajectory Distillation(STD),通过单轨迹蒸馏、Trajectory Bank 和基于 DINO-v2 的非对称对抗损失,实现 8-4 步高质量图像与视频风格化,在风格相似度和美学指标上超越 LCM、TCD、PCM 等加速模型。代码与预训练模型已开源,支持即插即用接入现有 SDXL 流程。

1月24日周五
  1. FireRedTeam GitHub 新仓库61

    FireRedTeam 开源 FireRedASR 工业级中文语音识别模型,含 LLM 与 AED 两个变体

    FireRedTeam 开源工业级语音识别模型 FireRedASR,支持普通话、中文方言和英语,含 8.3B 的 FireRedASR-LLM(Encoder-Adapter-LLM 架构)和 1.1B 的 FireRedASR-AED 两个变体。

    推荐理由:仓库给出两个变体的公开基准 CER/WER 对比数字和使用限制,读者可以据此评估它在中文语音识别里的可用性。

12月11日周三
9月2日周一
8月29日周四
8月21日周三
  1. FireRedTeam GitHub 新仓库41

    FireRedTeam 开源 PhotoPoster:高保真两阶段姿态驱动图像生成框架

    FireRedTeam 发布开源项目 PhotoPoster,一个高保真两阶段姿态驱动图像生成框架,通过引入精修阶段显著提升 i2i 图像质量,并同步开源预训练模型和基于 FastAPI 的 pose server。团队计划两周内发布 ComfyUI 支持及配套的 i2v 项目 DynamicPose,后续还将开放推理代码、训练代码和数据处理流程。

8月15日周四