跳到正文

智谱 GLM

智谱的 GLM 系列模型动态:旗舰开源发布、代码与推理能力迭代、商业化与生态进展的追踪。

当前仅显示精选新闻

最新精选

第 1–20 条 · 共 51 条
10月1日周四
  1. 机器之心 · 微信公众号74

    美国企业转向开放权重模型,中国开放模型吃到企业降本红利

    机器之心援引《金融时报》报道,美国企业开始把 AI 任务从 OpenAI、Anthropic 闭源模型迁移到开放权重模型上,中国公司 DeepSeek、智谱成为重要受益方。

    推荐理由:文章基于金融时报报道和调用数据,梳理美国企业用开放模型替代闭源 API 的成本与数据主权考量。

9月30日周三
  1. 晚点LatePost · 微信公众号72

    晚点调查:从 ZCode 上传数据事件到 AI 个人助理,用户数据的边界在哪里

    《晚点》复盘智谱 ZCode 默认上传用户 .git 项目历史的事件,涉事存储桶已删除、智谱道歉并向用户补偿 Token,并对比 xAI Grok Build 的类似行为。

    推荐理由:以 ZCode 和 Grok Build 上传事件为切口,拆解 7 款 AI 产品协议条款,帮读者理解 AI 个人助理时代的隐私边界问题。

  2. AI前线 · 微信公众号81

    OpenAI DevDay发布dots、Space与GPT-6.1 Sol,Codex接入GLM与Kimi,Pro 200额度腰斩

    OpenAI在DevDay上发布由GPT-6 Astra驱动的24小时个人智能体dots、协作套件Space与Pages,以及主打长程任务的GPT-6.1 Sol,其缓存价格降至0.10美元/百万Token。

    推荐理由:汇总了OpenAI DevDay多项发布的具体额度数字、定价与权限设计,还给出Pro 200降配等社区争议细节。

9月29日周二
  1. Anthropic Research82

    Anthropic 评测 GLM-5.3:可自主构建端到端漏洞利用且防护易被绕过

    Anthropic 发布对智谱 GLM-5.3 的网络安全能力分析,认为它是首个在无实质防护下开放权重的强网络攻击能力模型,与 NIST CAISI 评估结论大致一致。

    推荐理由:Anthropic 以一手评测数据说明 GLM-5.3 的漏洞利用能力与防护绕过率,并解释攻击者可及性与 Claude 的访问限制差异。

9月28日周一
  1. InfoQ · 微信公众号71

    智谱 ZCode 数据上传争议后公布补偿方案并开源,信任修复仍有缺口

    智谱 9 月 28 日公布 ZCode 数据上传争议补偿方案,付费用户可获 4 张周额度重置卡和 4 张 5 小时额度重置卡,9 月 28 日至 10 月 7 日期间每日向全体用户发放十万份 1 亿 token。

    推荐理由:文章围绕 ZCode 开源与补偿方案,梳理了仍缺失的代码历史、数据规模披露和核查范围,可帮助读者理解 Coding Agent 数据边界的验证难题。

9月9日周三
8月29日周六
  1. @emollick77

    GLM-5.3 开放权重,发布方称这是其面向 agentic coding 与网络防御能力最强的模型,可下载、运行并自行定制。Ethan Mollick 认为,随着开放权重模型越来越强,公开模型卡、做红队测试变得愈发重要,因为任何开放模型都可以被绕过护栏,外界需要了解风险所在。

    引用@Zai_org@Zai_org

    GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf

    推荐理由:作者在开放权重模型能力持续上升的背景下,提出模型卡与红队测试的公开需要同步跟上。

8月28日周五
  1. SiliconFlow73

    智谱(Zai)开源 GLM-5.3,SiliconFlow 提供 Day-0 支持,模型已可在其平台使用。该模型总计 744B / 激活 40B,与 GLM-5.2 基座相同,主要靠后训练进一步提升智能,官方称在编程和智能体基准上可与 Fable 5 和 GPT-5.6 Sol 竞争。SiliconFlow 称其在 OpenRouter 上 GLM-5.2 token 份额排名第一。

    推荐理由:原文给出参数规模、与 GLM-5.2 的关系及基准表现,读者可据此评估是否切换到 GLM-5.3。

  2. @OpenRouter76

    GLM-5.3 现已开放权重,并上线 OpenRouter,具备 1M 上下文和可配置的推理力度。该模型由 @Zai_org 发布,面向复杂软件工程、长程智能体和网络安全场景。Zai 称这是其在智能体编程与网络防御方面能力最强的模型,权重可供下载、运行和定制。

    引用@Zai_org@Zai_org

    GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf

    推荐理由:GLM-5.3 以开源权重上线托管平台,1M 上下文与可调推理力度可供开发者直接接入评估。

  3. @kimmonismus71

    GLM-5.3 已在 Hugging Face 正式上线,作者列出了在本地运行该模型的硬件门槛。FP8 需 10–12× H100 或 8× H200;4-bit/NVFP4 约 390–430GB,可用一台 512GB Mac Studio 或 4× DGX Spark;激进 2-bit 约 230–250GB,一台 256GB Mac Studio 或 2× DGX Spark,但有质量和上下文方面的权衡。首批 GGUF 和 NVFP4 量化已开始出现。

    引用@kimmonismus@kimmonismus

    Quick reminder: in 4 hours you will be able to download and run sota AI. If you have enough compute ofc. What a time to be alive. https://t.co/T6bs1VnVG1

    推荐理由:GLM-5.3 上线后给出了各量化档位的显存与硬件门槛,可供本地部署选型参考。

8月27日周四
  1. @SiliconFlowAI66

    Zai 开源发布 GLM-5.3-Flash,并已在 SiliconFlow 上线,SiliconFlow 提供 Day-0 支持。该模型为 320B 总参数、18B 激活参数,原生多模态,采用 MIT 许可。官方称其强于 GLM-5.2 且便宜 90%,在编码与 Agent 任务上接近 Opus 4.8,成本低 95% 以上。

    推荐理由:GLM-5.3-Flash 以 320B 总参、18B 激活的开源配置上线 SiliconFlow,读者可据此对比它与前代在成本上的变化。

  2. 数字生命卡兹克 · 微信公众号77

    智谱发布 GLM-5.3-Flash,320B MoE 原生多模态模型

    智谱发布 GLM-5.3-Flash,即一周来在 OpenRouter 和 OpenCode 上匿名测试的 OX Alpha。该模型总参数 320B、每次激活 18B,是 GLM-5 系列首个原生多模态模型,支持图像、视频和文本输入,原生上下文 100 万,使用 30 万亿 Token 多模态数据预训练。

    推荐理由:模型定价与国产卡推理规模是这篇实测里最值得看的两点,读者可据此判断日常任务的模型选择。

  3. @omarsar070

    @Zai_org 发布 GLM-5.3-Flash,一个 320B-A18B 的原生多模态模型,支持 1M token 上下文窗口,采用 MIT 许可,权重、API 与编码方案等入口同步开放。该模型此前以 Ox Alpha 为名预览,完全运行在中国 AI 芯片上。Elvis Saravia 称自己在 /eli5 视觉讲解场景中使用它效果好,并推荐在 Pi 或 Hermes Agent 的新 agent playground 中试用。

    原始视频预览图;未保存可播放视频URL
    引用@Zai_org@Zai_org

    Introducing GLM-5.3-Flash - Leading capabilities at a highly competitive price - Natively multimodal with a 1M-token context window - A 320B-A18B model released under the MIT License - Previously previewed as Ox Alpha, running entirely on Chinese AI chips Blog: https://t.co/tzOmB7gdZP Available now across all official platforms: Weights: https://t.co/9LRMahY9Wa API: https://t.co/VcaQnzYmS9 Coding Plan: https://t.co/Nk8Y98HNhU ZCode: https://t.co/Peepqv4XSx Chat: https://t.co/WCqWT0qCQb AutoClaw: https://t.co/aGEG5HqTTb

    推荐理由:引用内容公布了 GLM-5.3-Flash 的参数量、上下文窗口与开源许可,读者可据此判断其定位与获取方式。

  4. 量子位 · 微信公众号81

    智谱发布并开源 GLM-5.3 Flash,为 GLM-5 系列首个原生多模态模型

    智谱发布并开源 GLM-5.3 Flash,这是 GLM-5 系列首个原生多模态模型,总参数 320B、激活参数 18B,能力超过体量 753B 的 GLM-5.2。该模型在 AA 榜单拿到 57 分,与 Claude Opus 4.8 持平,限时折扣价为后者的 1/40,并已接入 ZCode 和开放 API。模型权重已在 Hugging Face 开源,承接线上真实请求的算力来自国产芯片。

    推荐理由:实测呈现了这个 320B 模型在多模态与编码任务上的表现,并交代了低价与国产芯片部署两层背景。

8月26日周三
  1. @AYi_AInotes70

    彭博确认在 OpenRouter 匿名屠榜的 Ox Alpha 是智谱 GLM 系列的新迭代,今晚将直接开源放权重。

    原始视频预览图;未保存可播放视频URL
    引用@AYi_AInotes@AYi_AInotes

    牛来大模型刚被彭博社破案了! 在 OpenRouter 上悄悄屠榜、调用量超过 DeepSeek 一倍的神秘模型 Ox Alpha, 背后竟然是智谱,更绝的是官方确认今晚直接开源权重, 狂刷了数十万亿 token、在真实 Coding 里跑出 80% 峰值,智谱这次是真的要杀疯了, 前阵子大家都在猜这个匿名模型到底是哪家大厂的马甲, 因为它在排位赛上狂刷了数十万亿 token, 开发者用脚投票把它送上了第一, 它真正狠的地方,是把 Flash 级别的速度和成本,做出了中上游前沿模型的实战能力: 1M 超长上下文、原生支持图片和视频多模态, 而且是推理优先的架构,写代码时会先做规划再调工具 社区独立跑测试,在 10 个高难度真实 Coding 任务里拿下了 80% 的过关率, 全量 DeepSWE 跑出 64.6%, 直接咬住了 Claude Opus 4.8 和 Gemini 3.7 Flash 的身位 它不是那种打虚空跑分的绝对 SOTA, 但一个成本极低、速度极快、能看懂视频还能写复杂代码的 Flash 模型, 今晚一旦把权重放出来,无论是本地部署还是第三方 API,生态杀伤力完全不可同日而语 刚发完开源顶流 GLM-5.3,转头就把这个高频 Agent 生产力核弹开源出来, 大模型的竞争,终于从比拼谁的参数更大,彻底转向谁能让开发者用最低成本把活干完了啊

    推荐理由:匿名屠榜模型被确认为智谱 GLM 新迭代并将开源权重,读者可了解它对第三方 API 与本地部署成本的影响。

  2. @rohanpaul_ai66

    Z.ai 披露此前匿名上线的模型 Ox Alpha 实为 GLM-5.3-Flash,作者转述的报道称该服务由数万个国产加速器支撑,而非 NVIDIA GPU 集群。

    引用@rohanpaul_ai@rohanpaul_ai

    OxAlpha is a new iteration of GLM, from China’s Z .ai And it will change how you run long running agent fast. --- bloomberg .com/news/articles/2026-08-26/china-s-z-ai-made-ox-alpha-stealth-model-that-rivals-deepseek https://t.co/ZOTlnBgOsy

    推荐理由:原文确认 Ox Alpha 即 GLM-5.3-Flash,并给出参数规模、架构改动与基准对比,便于对照其相对 GLM-5.2 的位置。