跳到正文

#开源生态

今日 0 条
10月1日周四
9月30日周三
9月29日周二
  1. Google Cloud: Databases65

    Google Cloud 分析创业公司为何需要在前沿 API 之外搭配 Gemma 4 开源模型

    Google Cloud 发文主张创业公司采用“复合 AI 栈”,用开源的 Gemma 4 处理边缘执行、高吞吐分流、任务微调和垂直场景,把 Gemini 留给复杂推理。

    推荐理由:文章用三个创业案例和四类工作负载说明开源模型与前沿 API 搭配的架构取舍,适合正在做模型选型的团队参考。

9月28日周一
9月21日周一
  1. Nathan Lambert: Interconnects74

    Nathan Lambert 撰文解析开源权重模型格局:中国领先约 2-5 个月追赶闭源前沿

    Nathan Lambert 将其给美国国会的演讲稿整理为 2026 年开源权重模型现状综述,认为中国模型(GLM-5.3、Kimi K3 等)已明确领先美国开源模型,AAII 得分 45/44 对美国最佳 26,开源与闭源前沿差距约 2-5 个月。

    推荐理由:作者以自建数据和演讲稿形式梳理中美开源权重模型的差距、采用与风险,读者可获得一份少见的系统性对比视角。

9月11日周五
  1. Nathan Lambert: Interconnects61

    Nathan Lambert 整理开源 AI 与开放模型必读书单

    Interconnects 作者 Nathan Lambert 公布一份开放模型研究书单,覆盖开放模型战略、中美竞争、技术细节与蒸馏争议等主题,并承诺持续更新。书单收录 Mark Zuckerberg、Irene Solaiman、SemiAnalysis、Kevin Xu 等人的文章与论文,并指出当前开源与闭源模型的差距约为 4-6 个月,2024 年前后领先的开放模型均来自中国实验室。

8月24日周一
  1. Andrew Ng50

    在捍卫 AI 开放性的斗争中,Marin 项目是模型训练开放性的一份珍贵示范——开放代码、数据、配方,甚至实验结果。公开分享 AI 研究曾是常态;我很感激 @percyliang 的开放实验室做法。

    引用Percy Liang@percyliang

    🚢 Marin 535B-A23B started training this week! As usual, the whole process is open. Voyage plan: pretraining (80%) + midtraining (20%) on 18.75T tokens on 11 x GB200 NVL72 for ~3 months (2.7e24 FLOPs). Post-training will follow. Before kicking off the run, we trained a 4-rung scaling ladder from 1.6B-A61M (48B tokens) to 27.7B-A1.2B (926B tokens) to debug issues, and to make a forecast of our hero run. This is by far our biggest run, so definitely expecting the unexpected.

8月18日周二
8月17日周一
8月15日周六
  1. Nathan Lambert: Interconnects71

    Nathan Lambert 解析 GLM-5.3 为何能紧跟前沿

    Z.ai 发布 GLM-5.3,目前仅在 coding plan 提供,两周内将开放权重到 Hugging Face。作者认为其与 GLM-5.2 同底座、靠大幅扩展后训练提升成绩,在部分智能体编码基准上超越 Kimi K3 甚至个别超越 Claude Fable 5 或 GPT-5.6-Sol,参数约 750B。

    推荐理由:作者给出了对 GLM-5.3 成绩来源的解释框架,包括发布节奏、后训练策略和 RL 数据产业等背景,可用于理解中美前沿模型竞争的成因。

7月22日周三
  1. Nathan Lambert: Interconnects63

    Interconnects 播客复盘开源模型:Kimi K3 体验、Qwen 大模型计划与蒸馏争论

    Nathan Lambert 与 Florian Brand 做季度开源模型复盘,讨论 Kimi K3 发布后的使用体验、GLM 5.2 的作用以及中国模型为何能追近闭源前沿。二人反驳 Ben Thompson 关于蒸馏在 RL 阶段更有影响的说法,认为 SFT 蒸馏收益有限,并讨论了限制中国开放权重模型可能带来的网络安全防御风险。

6月22日周一
  1. Nathan Lambert: Interconnects82

    Nathan Lambert:GLM-5.2 是开源智能体模型的台阶式跃迁

    Nathan Lambert 撰文认为 Z.ai 于 6 月 13 日向 GLM Coding Plan 用户推出、6 月 16 日以 MIT 许可开源的 GLM-5.2,是首个在编码智能体场景中真正好用的开源权重模型,社区评测显示其在 Arena 智能体榜单上是唯一能与 OpenAI 和 Anthropic 最新模型抗衡的开源模型。

    推荐理由:作者以亲测和社区评测为依据,把 GLM-5.2 与 DeepSeek R1 时刻类比,并展开开源与闭源差距及监管风险的独特分析。

6月19日周五