跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

当前仅显示精选新闻
344条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 101–120 条 · 共 344 条
9月2日周三
  1. IT Home78

    英伟达接近以 140 亿美元收购 Hugging Face,最快本周达成协议

    彭博社报道称,英伟达正就收购 Hugging Face 展开深入谈判,交易总规模接近 140 亿美元,其中收购价为 129 亿美元,另含面向 Hugging Face 员工的 10 亿美元留任激励,最快可能本周达成协议,双方尚未签署最终协议。

    推荐理由:交易若达成,英伟达将掌控开发者展示与共享 AI 模型的核心平台,可与它近一年的多笔并购对照着看。

9月1日周二
  1. @TencentHunyuan72

    腾讯混元称 Hy4 preview 在 AI 研究中自行发现推理瓶颈,通过算子融合与通信优化把端到端吞吐提升 31.8%,且在不同上下文长度和并发下保持稳定。该模型此前以 770B 总参数、49B 激活参数、1M 上下文发布,主打生产力与开源前沿,并给出博客、HuggingFace 和 GitHub 入口。

    引用@TencentHunyuan@TencentHunyuan

    🚀 Hy4 preview is here. 770B, 49B active, 1M context. Built for productivity. Open source frontier. Consistent affordable price. Use it. Tell us what breaks. More on Hy blog:https://t.co/rbl1IWRk3C HuggingFace:https://t.co/mE9wevH5XR Github:https://t.co/pyl9zckpoL https://t.co/4iW6gSuZKr

    推荐理由:官方给出模型自主定位推理瓶颈并完成优化的具体数字,可供观察自我优化在推理侧的落地方式。

8月31日周一
  1. MiniMax 稀宇科技 · 微信公众号66

    MiniMax 将 H3 Max 768P 与 480P 接入开放平台,支撑实时 AI 直播

    MiniMax 将 H3 Max 768P 与 H3 Max 480P 接入开放平台和 MiniMax Design。H3 Max 生成 5 秒 768p 音视频不到 3 秒,吞吐量约为 MiniMax H3 的 35 倍;fal 工程师和 Pieter Levels 已基于它搭建 Twitch 实时直播与 24 小时 AI 直播网站。

    推荐理由:官方给出 H3 Max 的生成速度、吞吐量对比和接入入口,读者可以判断实时 AI 直播这类场景是否已经跑得通。

8月30日周日
  1. @AYi_AInotes68

    腾讯混元发布 Hy4 preview,770B 总参数、49B 激活参数、1M 上下文,面向生产力场景并开源,官方称保持可负担的一致定价。官方同时给出博客、HuggingFace 和 GitHub 入口,并邀请用户反馈问题。转发该消息的博主称 Hy4 已进入 Arena 代码榜全球第 5。

    原始视频预览图;未保存可播放视频URL
    引用@TencentHunyuan@TencentHunyuan

    🚀 Hy4 preview is here. 770B, 49B active, 1M context. Built for productivity. Open source frontier. Consistent affordable price. Use it. Tell us what breaks. More on Hy blog:https://t.co/rbl1IWRk3C HuggingFace:https://t.co/mE9wevH5XR Github:https://t.co/pyl9zckpoL https://t.co/4iW6gSuZKr

    推荐理由:混元 Hy4 preview 以 770B 参数和 1M 上下文开源,Arena 代码榜排名给出编码能力的横向参照。

8月29日周六
  1. AGI Hunt · 微信公众号77

    腾讯发布混元 Hy4 preview:770B 参数、1M 上下文并开源权重

    腾讯发布混元 Hy4 preview,总参数 770B、激活 49B,支持 1M tokens 上下文,权重与 FP8 版本已在 HuggingFace、GitHub、ModelScope、GitCode 开源,采用 Apache 2.0 协议。

    推荐理由:作者用游戏开发、PPT 制作和云账单分析等多场景实测,展示 Hy4 preview 的能力边界与同代模型对照。

  2. @emollick77

    GLM-5.3 开放权重,发布方称这是其面向 agentic coding 与网络防御能力最强的模型,可下载、运行并自行定制。Ethan Mollick 认为,随着开放权重模型越来越强,公开模型卡、做红队测试变得愈发重要,因为任何开放模型都可以被绕过护栏,外界需要了解风险所在。

    引用@Zai_org@Zai_org

    GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf

    推荐理由:作者在开放权重模型能力持续上升的背景下,提出模型卡与红队测试的公开需要同步跟上。

  3. LMSYS Blog60

    SGLang 发布 SSD Expert Pack,在消费级硬件上运行 DeepSeek-V4-Flash 和 Kimi-K3

    SGLang 将 SSD-LLaMA 的核心思路引入 MoE 推理,把放不进 VRAM 和内存的路由专家权重放在 NVMe SSD 上,通过 Expert Pack 连续布局、O_DIRECT 直接 I/O、pinned 暂存和 GPU 缓存,只加载 router 选中的专家。

    推荐理由:原文给出完整机制说明和单卡实测数据,读者可以据此评估 NVMe SSD 承载超大 MoE 模型的可行性。

8月28日周五
  1. SiliconFlow73

    智谱(Zai)开源 GLM-5.3,SiliconFlow 提供 Day-0 支持,模型已可在其平台使用。该模型总计 744B / 激活 40B,与 GLM-5.2 基座相同,主要靠后训练进一步提升智能,官方称在编程和智能体基准上可与 Fable 5 和 GPT-5.6 Sol 竞争。SiliconFlow 称其在 OpenRouter 上 GLM-5.2 token 份额排名第一。

    推荐理由:原文给出参数规模、与 GLM-5.2 的关系及基准表现,读者可据此评估是否切换到 GLM-5.3。

  2. @OpenRouter76

    GLM-5.3 现已开放权重,并上线 OpenRouter,具备 1M 上下文和可配置的推理力度。该模型由 @Zai_org 发布,面向复杂软件工程、长程智能体和网络安全场景。Zai 称这是其在智能体编程与网络防御方面能力最强的模型,权重可供下载、运行和定制。

    引用@Zai_org@Zai_org

    GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf

    推荐理由:GLM-5.3 以开源权重上线托管平台,1M 上下文与可调推理力度可供开发者直接接入评估。

  3. AGI Hunt · 微信公众号79

    阿里千问开源 Qwen3.8-Flash-Next,6B 激活在 9 项基准中 8 项超过 Opus 4.6 Max

    阿里千问于 8 月 26 日晚开源 Qwen3.8-Flash-Next 权重,生产版 Qwen3.8-Flash 同步上线千问 AI 平台 API,官方称这套 Next 架构是 Qwen4 系列的雏形。

    推荐理由:作者在 Qoder 中实测了这款每 token 仅激活 6B 的 MoE 模型,并拆解其稀疏注意力与外挂 N-gram 表的设计取舍。

  4. @kimmonismus66

    腾讯发布开源模型 Hy4 Preview,770B 参数、49B 激活参数、1M token 上下文窗口。腾讯称 Hy4 可并行协调多个 Codex 会话、评估其输出并调整研究方向,在八个基准上超过 Codex 单独工作,目标场景是长程编码、多文件办公任务与科学研究。作者认为这是一次扎实的发布,放在几个月前属于绝对的 sota。

    原始视频预览图;未保存可播放视频URL原始视频预览图;未保存可播放视频URL
    引用@TencentHunyuan@TencentHunyuan

    🚀 Hy4 preview is here. 770B, 49B active, 1M context. Built for productivity. Open source frontier. Consistent affordable price. Use it. Tell us what breaks. More on Hy blog:https://t.co/rbl1IWRk3C HuggingFace:https://t.co/mE9wevH5XR Github:https://t.co/pyl9zckpoL https://t.co/4iW6gSuZKr

    推荐理由:腾讯开源 770B 参数模型并给出并行调度多个 Codex 会话的智能体研究能力,可对照其八个基准结果判断定位。

  5. @testingcatalog71

    腾讯发布开放权重模型 Hy4 Preview,采用 Apache License 2.0 许可。该模型为新一代 Mixture-of-Experts(MoE)旗舰模型,770B 参数、49B 激活、1M 上下文窗口。腾讯官方博客、HuggingFace 与 GitHub 均已放出模型入口,作者表示将开始测试。

    引用@TencentHunyuan@TencentHunyuan

    🚀 Hy4 preview is here. 770B, 49B active, 1M context. Built for productivity. Open source frontier. Consistent affordable price. Use it. Tell us what breaks. More on Hy blog:https://t.co/rbl1IWRk3C HuggingFace:https://t.co/mE9wevH5XR Github:https://t.co/pyl9zckpoL https://t.co/4iW6gSuZKr

    推荐理由:腾讯以 Apache License 2.0 开放 770B 参数 MoE 模型,可对照其与现有开源模型的参数与上下文规模。