跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

当前仅显示精选新闻
561条精选相关主题产品更新论文研究开源生态

最新精选

第 541–560 条 · 共 561 条
10月27日周一
  1. MiniMax Blog74

    MiniMax 开源并发布面向 Agent 与编码的 MiniMax M2

    MiniMax 开源并发布面向 Agent 和编码场景的模型 MiniMax M2,API 定价为每百万输入 tokens $0.30/¥2.1、输出 $1.20/¥8.4,为 Claude 4.5 Sonnet 的 8%,推理速度接近其两倍,TPS 约 100。

    推荐理由:官方给出了 M2 的定价、推理速度、基准成绩与部署方式,读者可据此评估其在 Agent 工作流中的成本与性能权衡。

10月14日周二
  1. Microsoft AI News61

    Microsoft AI 发布首个完全自研图像生成模型 MAI-Image 1,登上 LMArena 文生图前十

    Microsoft AI 于 2025 年 10 月 13 日宣布 MAI-Image 1,这是其首个完全在内部开发的图像生成模型,首日进入 LMArena 文生图模型前十。

    推荐理由:微软首次完全自研的图像生成模型,官方说明了训练重点、擅长场景和后续落地产品,可了解其定位与可用入口。

9月29日周一
9月22日周一
  1. DeepSeek API updates65

    DeepSeek-V3.1-Terminus 发布,deepseek-chat 与 deepseek-reasoner 均已升级

    DeepSeek 官方宣布 deepseek-chat 和 deepseek-reasoner 均已升级为 DeepSeek-V3.1-Terminus,分别对应其非思考模式和思考模式。此次更新保持模型原有能力,针对用户反馈改进了语言一致性,缓解中英文混杂和偶发异常字符问题,并优化了 Code Agent 与 Search Agent 的表现。

    推荐理由:官方说明升级后的接口对应关系和两类具体改进,现有用户可据此判断是否切换或观察效果。

8月29日周五
8月21日周四
7月15日周二
7月11日周五
6月10日周二
5月28日周三
5月21日周三
5月7日周三
5月1日周四
  1. Suno Blog64

    Suno 发布 v4.5 音乐生成模型

    Suno 发布最新音乐生成模型 v4.5,曲风选项大幅扩充且更贴合描述,人声情感与音域增强,歌曲最长可达 8 分钟。新增提示词增强助手,Covers 与 Personas 可组合使用,生成速度与音频质量也有明显提升。

    推荐理由:官方公告列出了 v4.5 在曲风、人声、音质和生成速度上的具体改进,音乐创作工作流的变化可以直接对照查看。

3月24日周一
3月17日周一
  1. Mistral AI65

    Mistral 发布 Mistral Small 3.1:24B 多模态开源模型,128k 上下文

    Mistral AI 发布 Mistral Small 3.1,相比 Mistral Small 3 提升文本性能,新增多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens/秒,官方称超越 Gemma 3 和 GPT-4o Mini 等同级模型。

    推荐理由:官方给出了与 Gemma 3 和 GPT-4o Mini 的对比数据、部署门槛和开放下载渠道,可据此评估端侧与低成本部署选择。

1月24日周五
  1. FireRedTeam GitHub 新仓库61

    FireRedTeam 开源 FireRedASR 工业级中文语音识别模型,含 LLM 与 AED 两个变体

    FireRedTeam 开源工业级语音识别模型 FireRedASR,支持普通话、中文方言和英语,含 8.3B 的 FireRedASR-LLM(Encoder-Adapter-LLM 架构)和 1.1B 的 FireRedASR-AED 两个变体。

    推荐理由:仓库给出两个变体的公开基准 CER/WER 对比数字和使用限制,读者可以据此评估它在中文语音识别里的可用性。

12月26日周四
9月5日周四
6月28日周五
5月14日周二
  1. Sam Altman Blog86

    Sam Altman 谈 GPT-4o 免费开放与全新语音模式

    Sam Altman 发文强调 GPT-4o 已免费向 ChatGPT 用户开放,且无广告,呼应其让强大 AI 工具普惠的使命。他称新的语音和视频模式是他用过的最好计算机界面,达到人类水平的响应时间和表现力,体验自然流畅,并展望未来加入可选个性化、访问个人信息和代用户执行操作等能力。

    推荐理由:作者本人解释免费开放 GPT-4o 的考量,并给出新语音模式的第一手使用感受,可作官方视角的背景补充。