跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

当前仅显示精选新闻
575条精选相关主题产品更新论文研究开源生态

最新精选

第 261–280 条 · 共 575 条
8月17日周一
  1. Mistral AI84

    Mistral AI 发布 7.3B 参数开源模型 Mistral 7B

    Mistral AI 发布 7.3B 参数的 Mistral 7B,称其在全部评测上超过 Llama 2 13B,多项基准接近 Llama 1 34B。该模型采用分组查询注意力(GQA)和滑动窗口注意力(SWA),在 16k 序列长度、4k 窗口下推理提速 2x,并能在 8192 序列长度下节省一半缓存。

    推荐理由:官方给出与 Llama 2 系列同评估管线的对比和 Apache 2.0 授权,便于判断同尺寸模型的选型空间。

8月16日周日
  1. Anthropic Newsroom85

    Anthropic 发布 Claude Sonnet 5,智能体性能接近 Opus 4.8

    Anthropic 发布 Claude Sonnet 5,称其为最具智能体能力的 Sonnet 模型,即日起成为 Free 和 Pro 套餐默认模型,Max、Team、Enterprise 用户也可使用,定价为每百万输入 token 2 美元、每百万输出 token 10 美元。

    推荐理由:Anthropic 官方给出 Sonnet 5 与 Sonnet 4.6、Opus 4.8 的对比数据,读者可据此判断同级模型的智能体能力与成本差距。

  2. Anthropic Newsroom86

    Anthropic 发布 Claude Opus 5,编码与知识工作基准领先且定价与 Opus 4.8 持平

    Anthropic 发布 Claude Opus 5,在 Frontier-Bench、GDPval-AA 等编码与知识工作评测上达到领先水平,定价与 Opus 4.8 相同,为每百万输入 token 5 美元、输出 25 美元。

    推荐理由:官方给出 Opus 5 在编码与知识工作基准上的位置和定价,可对照前代 Opus 4.8 判断性能与成本的取舍。

8月15日周六
  1. Nathan Lambert: Interconnects71

    Nathan Lambert 解析 GLM-5.3 为何能紧跟前沿

    Z.ai 发布 GLM-5.3,目前仅在 coding plan 提供,两周内将开放权重到 Hugging Face。作者认为其与 GLM-5.2 同底座、靠大幅扩展后训练提升成绩,在部分智能体编码基准上超越 Kimi K3 甚至个别超越 Claude Fable 5 或 GPT-5.6-Sol,参数约 750B。

    推荐理由:作者给出了对 GLM-5.3 成绩来源的解释框架,包括发布节奏、后训练策略和 RL 数据产业等背景,可用于理解中美前沿模型竞争的成因。

8月14日周五
8月13日周四
  1. FireRedTeam GitHub 新仓库64

    FireRedTeam 开源 FireRedTTS3 语音生成与编辑模型,支持 24 种语言和 21 种中文方言

    FireRedTeam 发布 FireRedTTS3 的 PyTorch 代码与模型,基于语义增强连续语音表示,统一语音生成与编辑,含 Base 和 Instruct 两个变体,采用 Apache-2.0 许可。

    推荐理由:仓库给出完整评测数字和安装使用入口,读者可以据此评估它在多语言克隆和语音编辑上的实际表现。

  2. DeepSeek68

    DeepSeek 发布 DeepSeek-V4-Pro,重点升级 Agent 能力并已在 app/web 的 Expert Mode 和 API 上线,模型名不变。V4-Pro 与 V4-Flash 支持灵活推理档位,简单任务用 low、日常 Agent 工作流用 high、复杂任务用 max。同时原生支持 OpenAI Responses API,针对 Codex 优化并提供一键设置,详情见 API 文档。

    推荐理由:发布方直接给出 Agent 能力升级、可调推理档位和 OpenAI Responses API 兼容,读者可对照判断是否切换日常模型。

  3. Simon Willison76

    DeepSeek V4 Pro 0813 上线 OpenRouter,权重随后在 Hugging Face 开放

    DeepSeek 最新 Pro 模型 DeepSeek V4 Pro 0813 已通过 API 上线,作者因找不到官方发布页面而链接到 OpenRouter;随后更新称权重已在 Hugging Face 开放,1.7T 参数、893 GB。

    推荐理由:记录了新模型仅以 API 形式上线、权重随后开放至 Hugging Face,以及作者自测不同推理档位的输出差异。

  4. 量子位 · 微信公众号78

    DeepSeek V4 Pro 正式版发布,多项基准对标 Fable 5

    DeepSeek V4 Pro 正式版发布,API 平台已上线 DeepSeek-V4-Pro-0813,官方博客尚未发布。在 HLE、Terminal Bench、Cybergym、DeepSWE 等 Agent 基准上,它几乎全面超过 Opus 4.8,逼近 Fable 5,部分榜单反超;百万 tokens 输入 3 元、缓存命中 0.025 元、输出 6 元。

    推荐理由:素材给出多项 Agent 基准对比与 API 定价,可据此判断国产开源模型与闭源前沿的差距及调用成本。