美国企业转向开放权重模型,中国开放模型吃到企业降本红利
机器之心援引《金融时报》报道,美国企业开始把 AI 任务从 OpenAI、Anthropic 闭源模型迁移到开放权重模型上,中国公司 DeepSeek、智谱成为重要受益方。
推荐理由:文章基于金融时报报道和调用数据,梳理美国企业用开放模型替代闭源 API 的成本与数据主权考量。
智谱的 GLM 系列模型动态:旗舰开源发布、代码与推理能力迭代、商业化与生态进展的追踪。
当前仅显示精选新闻机器之心援引《金融时报》报道,美国企业开始把 AI 任务从 OpenAI、Anthropic 闭源模型迁移到开放权重模型上,中国公司 DeepSeek、智谱成为重要受益方。
推荐理由:文章基于金融时报报道和调用数据,梳理美国企业用开放模型替代闭源 API 的成本与数据主权考量。
《晚点》复盘智谱 ZCode 默认上传用户 .git 项目历史的事件,涉事存储桶已删除、智谱道歉并向用户补偿 Token,并对比 xAI Grok Build 的类似行为。
推荐理由:以 ZCode 和 Grok Build 上传事件为切口,拆解 7 款 AI 产品协议条款,帮读者理解 AI 个人助理时代的隐私边界问题。
OpenAI在DevDay上发布由GPT-6 Astra驱动的24小时个人智能体dots、协作套件Space与Pages,以及主打长程任务的GPT-6.1 Sol,其缓存价格降至0.10美元/百万Token。
推荐理由:汇总了OpenAI DevDay多项发布的具体额度数字、定价与权限设计,还给出Pro 200降配等社区争议细节。
Anthropic 发布对智谱 GLM-5.3 的网络安全能力分析,认为它是首个在无实质防护下开放权重的强网络攻击能力模型,与 NIST CAISI 评估结论大致一致。
推荐理由:Anthropic 以一手评测数据说明 GLM-5.3 的漏洞利用能力与防护绕过率,并解释攻击者可及性与 Claude 的访问限制差异。
智谱 9 月 28 日公布 ZCode 数据上传争议补偿方案,付费用户可获 4 张周额度重置卡和 4 张 5 小时额度重置卡,9 月 28 日至 10 月 7 日期间每日向全体用户发放十万份 1 亿 token。
推荐理由:文章围绕 ZCode 开源与补偿方案,梳理了仍缺失的代码历史、数据规模披露和核查范围,可帮助读者理解 Coding Agent 数据边界的验证难题。
推荐理由:公告列出了被指控的蒸馏渠道与行为检测指标,读者可看到模型输出和账号用量如何被当作判定依据。
Z.ai 发布 320B 参数、18B 激活参数的多模态 MoE 模型 GLM-5.3-Flash,阿里 Qwen 团队发布 125B 参数、6B 激活参数的 Qwen3.8-Flash-Next,两者在本周相隔一天开源。
推荐理由:文章逐层对比两份模型配置的相同选择与分歧,可据此了解开源模型架构正在收敛的方向。
GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf
推荐理由:作者在开放权重模型能力持续上升的背景下,提出模型卡与红队测试的公开需要同步跟上。
推荐理由:汇总了 GLM-5.3 的开源权重入口、基准数据与硬件门槛,可据此判断它在漏洞挖掘和编码任务上的效率位置。
推荐理由:原文给出参数规模、与 GLM-5.2 的关系及基准表现,读者可据此评估是否切换到 GLM-5.3。
GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf
推荐理由:GLM-5.3 以开源权重上线托管平台,1M 上下文与可调推理力度可供开发者直接接入评估。
Quick reminder: in 4 hours you will be able to download and run sota AI. If you have enough compute ofc. What a time to be alive. https://t.co/T6bs1VnVG1
推荐理由:GLM-5.3 上线后给出了各量化档位的显存与硬件门槛,可供本地部署选型参考。
推荐理由:官方宣布权重开放并给出下载与博客入口,读者可以据此评估 GLM-5.3 在智能体编码场景的可用性。
推荐理由:GLM-5.3-Flash 以 320B 总参、18B 激活的开源配置上线 SiliconFlow,读者可据此对比它与前代在成本上的变化。
智谱发布 GLM-5.3-Flash,即一周来在 OpenRouter 和 OpenCode 上匿名测试的 OX Alpha。该模型总参数 320B、每次激活 18B,是 GLM-5 系列首个原生多模态模型,支持图像、视频和文本输入,原生上下文 100 万,使用 30 万亿 Token 多模态数据预训练。
推荐理由:模型定价与国产卡推理规模是这篇实测里最值得看的两点,读者可据此判断日常任务的模型选择。
Introducing GLM-5.3-Flash - Leading capabilities at a highly competitive price - Natively multimodal with a 1M-token context window - A 320B-A18B model released under the MIT License - Previously previewed as Ox Alpha, running entirely on Chinese AI chips Blog: https://t.co/tzOmB7gdZP Available now across all official platforms: Weights: https://t.co/9LRMahY9Wa API: https://t.co/VcaQnzYmS9 Coding Plan: https://t.co/Nk8Y98HNhU ZCode: https://t.co/Peepqv4XSx Chat: https://t.co/WCqWT0qCQb AutoClaw: https://t.co/aGEG5HqTTb
推荐理由:引用内容公布了 GLM-5.3-Flash 的参数量、上下文窗口与开源许可,读者可据此判断其定位与获取方式。
Z AI 发布 GLM-5.3-Flash,320B 总参数、18B 激活参数,在 Artificial Analysis 智能指数以最高推理档位得 57 分,单任务成本 0.09 美元。
推荐理由:GLM-5.3-Flash 以约七分之一的单任务成本把智能指数做到与 GPT-5.6 Terra 持平,可作为成本敏感选型的比较样本。
智谱发布并开源 GLM-5.3 Flash,这是 GLM-5 系列首个原生多模态模型,总参数 320B、激活参数 18B,能力超过体量 753B 的 GLM-5.2。该模型在 AA 榜单拿到 57 分,与 Claude Opus 4.8 持平,限时折扣价为后者的 1/40,并已接入 ZCode 和开放 API。模型权重已在 Hugging Face 开源,承接线上真实请求的算力来自国产芯片。
推荐理由:实测呈现了这个 320B 模型在多模态与编码任务上的表现,并交代了低价与国产芯片部署两层背景。
彭博确认在 OpenRouter 匿名屠榜的 Ox Alpha 是智谱 GLM 系列的新迭代,今晚将直接开源放权重。
牛来大模型刚被彭博社破案了! 在 OpenRouter 上悄悄屠榜、调用量超过 DeepSeek 一倍的神秘模型 Ox Alpha, 背后竟然是智谱,更绝的是官方确认今晚直接开源权重, 狂刷了数十万亿 token、在真实 Coding 里跑出 80% 峰值,智谱这次是真的要杀疯了, 前阵子大家都在猜这个匿名模型到底是哪家大厂的马甲, 因为它在排位赛上狂刷了数十万亿 token, 开发者用脚投票把它送上了第一, 它真正狠的地方,是把 Flash 级别的速度和成本,做出了中上游前沿模型的实战能力: 1M 超长上下文、原生支持图片和视频多模态, 而且是推理优先的架构,写代码时会先做规划再调工具 社区独立跑测试,在 10 个高难度真实 Coding 任务里拿下了 80% 的过关率, 全量 DeepSWE 跑出 64.6%, 直接咬住了 Claude Opus 4.8 和 Gemini 3.7 Flash 的身位 它不是那种打虚空跑分的绝对 SOTA, 但一个成本极低、速度极快、能看懂视频还能写复杂代码的 Flash 模型, 今晚一旦把权重放出来,无论是本地部署还是第三方 API,生态杀伤力完全不可同日而语 刚发完开源顶流 GLM-5.3,转头就把这个高频 Agent 生产力核弹开源出来, 大模型的竞争,终于从比拼谁的参数更大,彻底转向谁能让开发者用最低成本把活干完了啊
推荐理由:匿名屠榜模型被确认为智谱 GLM 新迭代并将开源权重,读者可了解它对第三方 API 与本地部署成本的影响。
Z.ai 披露此前匿名上线的模型 Ox Alpha 实为 GLM-5.3-Flash,作者转述的报道称该服务由数万个国产加速器支撑,而非 NVIDIA GPU 集群。
OxAlpha is a new iteration of GLM, from China’s Z .ai And it will change how you run long running agent fast. --- bloomberg .com/news/articles/2026-08-26/china-s-z-ai-made-ox-alpha-stealth-model-that-rivals-deepseek https://t.co/ZOTlnBgOsy
推荐理由:原文确认 Ox Alpha 即 GLM-5.3-Flash,并给出参数规模、架构改动与基准对比,便于对照其相对 GLM-5.2 的位置。