跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

当前仅显示精选新闻
357条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 201–220 条 · 共 357 条
8月13日周四
  1. FireRedTeam GitHub 新仓库64

    FireRedTeam 开源 FireRedTTS3 语音生成与编辑模型,支持 24 种语言和 21 种中文方言

    FireRedTeam 发布 FireRedTTS3 的 PyTorch 代码与模型,基于语义增强连续语音表示,统一语音生成与编辑,含 Base 和 Instruct 两个变体,采用 Apache-2.0 许可。

    推荐理由:仓库给出完整评测数字和安装使用入口,读者可以据此评估它在多语言克隆和语音编辑上的实际表现。

  2. 赛博禅心 · 微信公众号82

    DeepSeek Harness 开发者预览版上线并开源

    DeepSeek Harness 开发者预览版上线并开源,定位为类似 Claude Code 的 Agent 框架。它采用插件式架构,模型、工具、技能、会话、沙箱、循环、UI 等能力均由可替换的插件组合,基于具备时空可组合性的 Cordis 插件系统构建。

    推荐理由:全文拆解了 DeepSeek Harness 的插件化架构与模式设计,读者可据此判断这类 Agent 框架的定制边界与取舍。

  3. GitHub Blog67

    AutoGPT:贡献者已 AI 优先,开源项目如何把规则写进代码库

    AutoGPT 创始 AI 工程师 Nicholas Tindle 分享应对 AI 智能体提交 pull request 的做法:把 AGENTS.md 和技能文件放到代码旁边,用 pull request 模板和覆盖率门槛当硬闸门,并让 CLA 签名充当人类识别器。

    推荐理由:AutoGPT 把 AGENTS.md、技能和 CI 门槛放到代码旁的做法,可以迁移到其他开源项目的维护流程里。

8月12日周三
  1. LMSYS Blog65

    SGLang 与 Miles 为 Qwen3.8-2.4T-A95B 提供 Day-0 支持

    SGLang 与 Miles 宣布 Day-0 支持 Qwen3.8-2.4T-A95B,这是千问最大的开源模型,总参数 2.4T、每 token 激活 95B,采用 69 层 GDN 线性注意力与 23 层 GQA 全注意力 3:1 交错的混合架构,MoE 含 512 专家 top-10 路由。

    推荐理由:SGLang 团队详解 Qwen3.8 混合注意力架构的推理支持方案,给出内核优化、并行布局与实测吞吐数字,可作部署参考。

8月10日周一
  1. Hugging Face Blog81

    Meta 发布开源多模态模型 Muse Glimmer-30B,主打本地智能体场景

    Meta 发布从 Muse 蒸馏而来的 30B 多模态模型 Muse Glimmer,采用 Apache 2.0 许可,面向本地隐私场景的智能体用途。模型由 2B ViT 视觉编码器和 28B 文本解码器组成,支持图像、视频、多模态工具调用和目标检测,并附带基于 DFlash 的可选投机解码。

    推荐理由:原文给出架构组成、基准对比和各推理框架的 day-0 用法,读者可以据此评估本地部署的可行路径。

8月7日周五
  1. Artificial Intelligence News77

    Stanford 的 Evo 2 模型生成对抗大肠杆菌的噬菌体

    Stanford 研究人员用 Evo 2 生成 DNA 序列合成了近 300 个噬菌体,实验室测试从中筛出 16 个对大肠杆菌杀伤力较强的噬菌体。Evo 2 由 Brian Hie 打造,此次一次性生成完整的 ΦX174 基因组,部分候选噬菌体在实验中适应性高于天然 ΦX174。研究还开发了计算框架以减少送交合成的候选基因组数量,Hie 已将 Evo 2 以开源软件形式发布。

    推荐理由:研究展示生成式模型从零设计完整噬菌体基因组并经实验室筛选验证,同时点出合成与验证环节的硬约束。

8月6日周四
8月5日周三
8月4日周二
  1. Mistral AI64

    Mistral AI 开源 3B 多模态安全分类器 Shieldstral

    Mistral AI 发布开源多模态安全分类器 Shieldstral,权重 3B,采用 Apache 2.0 协议。模型将内容审核改写为推理时的问答任务,用户用自然语言给出政策,无需重训即可适配文本、图像和 prompt–response 对的审核。

    推荐理由:原文解释了用问答式策略接口替代固定分类体系的设计思路,并给出训练数据构建方法,读者可以借鉴其小模型超越大模型的数据策略。

8月3日周一
  1. AI前线 · 微信公众号78

    阿里正式发布 Qwen3.8,2.4T 规模,自主编程 16 天做出 Hermes Agent 级框架

    阿里巴巴正式发布新一代基座大模型 Qwen3.8,旗舰版 Qwen3.8-Max 总参数量 2.4 万亿、激活 95B,采用稀疏 MoE 架构与混合注意力机制,支持视觉理解,上下文长度达 1M Tokens。

    推荐理由:原文给出 2.4T MoE 旗舰模型的参数规模、编程能力表现和 API 定价,便于比较其性价比定位。