跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

当前仅显示精选新闻
561条精选相关主题产品更新论文研究开源生态

最新精选

第 361–380 条 · 共 561 条
6月24日周三
  1. 硅星人Pro · 微信公众号80

    火山引擎 Force 大会发布豆包 2.1 Pro、Seedance 2.0 4K 等 5 款模型

    火山引擎在 6 月 23 日 Force 大会上发布豆包大模型 2.1 Pro、Seedance 2.0 4K 等 5 款新模型。Seedance 2.5 将于 7 月初上线,支持 30 秒单段原生视频直出和最多 50 个全模态素材联合生成。

    推荐理由:文章给出豆包 2.1 Pro 与 Seedance 系列的发布细节,可看到一个云厂商把强模型当作云入口的整体打法。

6月23日周二
  1. Mistral AI69

    Mistral 发布 Mistral OCR 4:支持边界框、块分类和置信度分数

    Mistral 发布 Mistral OCR 4,除提取文本外还返回边界框、块类型分类(标题、表格、公式、签名等)和逐页逐词的内联置信度分数,支持 170 种语言、10 个语言组。

    推荐理由:官方说明了新模型的结构化输出能力、基准得分及其已知评分缺陷,并给出 API 与 Document AI 的选择规则,便于读者判断适用场景。

  2. inclusionAI Hugging Face models62

    inclusionAI 发布 SingGuard-8b 策略自适应多模态安全护栏模型

    inclusionAI 发布 SingGuard 多模态安全护栏模型家族,支持文本、图像、图文及多语言、query 侧与 response 侧的安全评估。模型把生效的安全策略作为运行时输入而非固定训练分类,部署方无需重训即可按默认类别或自定义自然语言规则判定内容,并以 safe/unsafe 加匹配风险类别的 <answer> 标签输出结果。

    推荐理由:原文给出策略作为运行时输入的设计与多模态、多语言覆盖范围,读者可据此判断免重训适配审核规则的可行性。

6月22日周一
  1. inclusionAI Hugging Face models66

    inclusionAI 发布 Ling-2.6-1T-base 万亿参数 MoE 基座模型

    inclusionAI 发布 Ling-2.6-1T-base,一个总参数约 1T、激活约 63B 的细粒度 MoE 基座模型,由 Ling-2.0-1T-base 通过混合线性注意力改造而来,并作为 Ling-2.6 与 Ring-2.6 的共同基座。

    推荐理由:模型卡给出了从 Ling-2.0 改造的迁移流程与长上下文训练安排,读者可据此评估万亿级 MoE 基座的微调与部署成本。

6月17日周三
  1. Hugging Face Blog85

    GLM-5.2 发布,面向长周期任务并支持 1M token 上下文

    GLM-5.2 发布,是面向长周期任务的旗舰模型,首次在 1M token 上下文上提供该能力,并采用 MIT 开源协议。相比 GLM-5.1,它在 Terminal-Bench 2.1 上从 63.5 提升到 81.0,在 SWE-bench Pro 上从 58.4 提升到 62.1。

    推荐理由:GLM-5.2 将上下文扩展到 1M token 并以 MIT 协议开源,读者可对照它与 Claude Opus 4.8、GPT-5.5 在长周期基准上的差距。

  2. IT Home80

    摩尔线程在 MTT S5000 上完成智谱 GLM-5.2 的 Day-0 适配

    智谱上线并开源 GLM-5.2,在全球百万用户参与盲测的前端开发评估系统 Code Arena 上取得全球可用模型第一;摩尔线程同日宣布在 AI 训推一体全功能 GPU 智算卡 MTT S5000 上完成 Day-0 极速适配。

    推荐理由:材料给出国产 GPU 对 GLM-5.2 的 Day-0 适配细节,可观察长上下文推理的软硬件协同路径。

  3. AI寒武纪 · 微信公众号80

    智谱发布 GLM-5.2:753B 参数、1M token 上下文并完全开源

    智谱发布 GLM-5.2,以 MIT 协议完全开源,参数 753B,支持 1M token 上下文窗口,主打长程任务能力。文中称在相近 token 消耗下其能力介于 Opus 4.7 与 Opus 4.8 之间;FrontierSWE 得分 74.4,落后 Opus 4.8 约 1%,超过 GPT-5.5 的 72.6。

    推荐理由:文中给出 GLM-5.2 在长程编程基准上与 Opus 4.8 的分数对比,可看到开源模型在长任务上的位置。

6月15日周一
  1. 赛博禅心 · 微信公众号76

    MiniMax 开源 428B 参数 M3 模型权重,同步发布 MSA 技术论文

    MiniMax 开源了 MiniMax M3 模型权重,并同步发布 MSA(MiniMax Sparse Attention)技术论文。M3 是 MiniMax 的原生多模态旗舰模型,总参数 428B,激活参数 23B,文中称其是第一个从 Step 0 开始做多模态混合训练的开源模型。

    推荐理由:M3 从 Step 0 起做多模态混合训练并开源权重,同时公开 MSA 稀疏注意力论文,可了解其长上下文成本设计思路。

  2. inclusionAI Hugging Face models65

    inclusionAI 发布 Ming-omni-tts-16.8B-A3B 统一音频生成模型

    inclusionAI 发布 Ming-omni-tts-16.8B-A3B 统一音频生成模型,可在单通道内联合合成语音、环境声与音乐。模型基于自研 12.5Hz 连续 tokenizer 与 Patch-by-Patch 压缩,将 LLM 推理帧率降至 3.1Hz,并内置 100+ 音色与零样本语音设计。

    推荐理由:该模型在单通道内联合生成语音、环境声与音乐,并用方言与情感控制基准对比 CosyVoice3 与 Qwen3-TTS。

6月11日周四
  1. @berryxia66

    Google 发布实验性开源模型 DiffusionGemma,采用 diffusion 同时起草并精炼整块文本,而非逐词预测,宣称文本生成速度最高提升 4 倍。该模型以 Apache 2.0 许可开源,权重已在 Hugging Face 放出。转发者称其可在 18GB 消费级显卡上运行,速度达 1000+ token/s。

    引用Google (@Google)@Google

    Meet DiffusionGemma ⚡ Our latest experimental open model (Apache 2.0) that generates text up to 4x faster. Instead of predicting and typing just one word at a time like most language models, it drafts and refines entire blocks of text simultaneously. Here’s how it works 🧵 ↓

    推荐理由:Google 开源实验性文本生成模型,采用并行 diffusion 思路,读者可了解其与主流自回归生成在路线上的差异。

  2. Google DeepMind72

    Google DeepMind 发布开源实验模型 DiffusionGemma,文本生成速度最高提升 4 倍

    Google DeepMind 发布 Apache 2.0 开源的实验性文本扩散模型 DiffusionGemma,为 26B MoE 架构、推理时激活 3.8B 参数,在专用 GPU 上文本生成最高提速 4 倍,单张 NVIDIA H100 超过 1000 tokens/秒,量化后可放入 18GB 显存。

    推荐理由:官方给出了具体吞吐数字、显存占用和适用场景边界,读者可以据此判断扩散文本生成适合哪些本地工作流。

6月10日周三
  1. 量子位 · 微信公众号79

    Anthropic 发布 Claude Fable 5,首日实测对比 GPT-5.5

    Anthropic 发布 Claude Fable 5,称其进入 Mythos 新段位,模型开放首日开发者集中实测其编码、设计与网页搭建能力。网友将其与 GPT-5.5 同台对比,在《我的世界》复刻推特中 Fable 5 还原度更高,另有开发者称其在 FC Diamond 榜单成功率从 Opus 4.8 的约14%升到30%以上。

    推荐理由:汇总模型开放首日开发者在编码、设计与网页搭建上的实测反馈,可与前代及竞品表现对照。

  2. 赛博禅心 · 微信公众号84

    Claude Fable 5 全解析:Mythos 级模型加护栏后对外开放

    Anthropic 发布 Claude Fable 5,它与只开放给政府和特定机构的 Mythos 5 是同一个模型,区别在于护栏。Fable 5 定价为 $10/百万 token 输入、$50/百万 token 输出,Pro、Max、Team 等用户可在 6 月 22 号前使用(消耗 Opus 两倍额度),之后需花 usage credits。

    推荐理由:文章对比了 Fable 5 与 Mythos 5 的护栏差异,并给出作者实测中被退回 Opus 4.8 的体验。