跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

当前仅显示精选新闻
551条精选相关主题产品更新论文研究开源生态

最新精选

第 421–440 条 · 共 551 条
6月2日周二
  1. @MiniMax_AI73

    MiniMax 发布开源权重模型 M3,称其同时具备编码与智能体、1M 长上下文和原生多模态三项前沿能力。官方给出的基准成绩包括 SWE-Bench Pro 59.0%、Terminal Bench 2.1 66.0%、SWE-fficiency 34.8%、KernelBench Hard 28.8% 和 MCP Atlas 74.2%,并通过 MiniMax Sparse Attention 将上下文扩展至 1M。API 已在 platform.minimax.io 开放,MiniMax Code 入口为 code.minimax.io,权重与技术报告约 10 天后发布。

    引用MiniMax (official) (@MiniMax_AI)@MiniMax_AI

    Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier: 59.0% SWE-Bench Pro, 66.0% Terminal Bench 2.1, 34.8% SWE-fficiency, 28.8% KernelBench Hard, 74.2% MCP Atlas - MiniMax Sparse Attention scales context to 1M - Natively Multimodal from Step Zero API: platform.minimax.io Token Plan: platform.minimax.io/subscrib… 🚀New! MiniMax Code: code.minimax.io Weights & Tech Report in ~10 Days

    推荐理由:官方给出 M3 在编码与智能体基准上的具体分数和 1M 上下文,读者可据此对照同类开源模型的能力边界。

  2. @MiniMax_AI68

    MiniMax 发布开源权重模型 M3,称其为首个同时具备编码、Agent 与多模态三项前沿能力的模型。M3 在 SWE-Bench Pro 得 59.0%、Terminal Bench 2.1 得 66.0%、MCP Atlas 得 74.2%,并通过 MiniMax Sparse Attention 将上下文扩展到 1M,从 Step Zero 起原生多模态。API 与 Token Plan 已在 platform.minimax.io 开放,MiniMax Code 在 code.minimax.io,权重与技术报告约 10 天后发布。

    引用MiniMax (official) (@MiniMax_AI)@MiniMax_AI

    Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier: 59.0% SWE-Bench Pro, 66.0% Terminal Bench 2.1, 34.8% SWE-fficiency, 28.8% KernelBench Hard, 74.2% MCP Atlas - MiniMax Sparse Attention scales context to 1M - Natively Multimodal from Step Zero API: platform.minimax.io Token Plan: platform.minimax.io/subscrib… 🚀New! MiniMax Code: code.minimax.io Weights & Tech Report in ~10 Days

    推荐理由:原文列出 M3 的编码与 Agent 基准成绩及 1M 上下文能力,可对照开源模型的当前水位。

  3. @MiniMax_AI69

    MiniMax M3 已在 Vercel AI Gateway 上线,这是 MiniMax 首个长上下文模型,支持 1M token 上下文和多模态输入。上线首周提供 50% 折扣,模型标识为 minimax/minimax-m3。

    引用Vercel Developers (@vercel_dev)@vercel_dev

    MiniMax M3 is available on AI Gateway. MiniMax's first long-context model, with support for multimodal inputs. 50% off for the next week. 𝚖𝚘𝚍𝚎𝚕: '𝚖𝚒𝚗𝚒𝚖𝚊𝚡/𝚖𝚒𝚗𝚒𝚖𝚊𝚡-𝚖𝟹' vercel.com/changelog/minimax…

    推荐理由:MiniMax M3 通过 Vercel AI Gateway 开放调用,1M token 上下文与多模态输入是其主要能力变化。

  4. @alibaba_cloud74

    阿里云发布 Qwen3.7-Plus,一个把视觉与语言统一到同一个智能体基础模型中的多模态智能体模型。官方称其支持 GUI 与 CLI 统一操作、全模态输入的编码与生产力助理,以及感知、推理、grounding 和检索增强问答的视觉智能体能力,并可跨不同智能体框架泛化。该模型现通过阿里云 Model Studio API 提供,同时给出 Qwen Studio 与博客入口。

    推荐理由:官方列出多模态智能体的能力清单与 API 入口,读者可据此判断它在自身工作流中的可用性。

  5. @MiniMax_AI73

    MiniMax 的模型 M3 在上线首日接入 Cloudflare AI Gateway。Cloudflare 转发称 M3 是首个推进编码前沿的开源模型,支持 1M 上下文和原生多模态理解,首周对上下文不超过 512K 的请求提供 50% 折扣,可通过 AI Gateway 试用。

    引用Cloudflare Developers (@CloudflareDev)@CloudflareDev

    M3 from @MiniMax_AI is now available on Cloudflare AI Gateway: - First open model to push SOTA coding frontier - 1M context and native multimodal understanding - 50% off during the first week for requests ≤ 512K context Try it out through AI Gateway today! developers.cloudflare.com/ai…

    推荐理由:M3 上线当天即可通过 Cloudflare AI Gateway 调用,读者可据此了解这款开源编码模型的能力与首周折扣。

  6. @kimmonismus65

    千问(Qwen)发布多模态智能体模型 Qwen3.7-Plus,将视觉与语言统一到同一智能体底座。官方列出四项能力:GUI 与 CLI 统一操作、全模态输入的编码智能体与生产力助手、具备感知推理定位与搜索增强问答的视觉智能体,以及跨智能体框架泛化,现已通过阿里云 Model Studio 开放 API(Blog:qwen.ai/blog?id=qwen3.7-plus)。转发者 @kimmonismus 认可其多模态表现,但质疑官方为何将自家模型与 GPT-5.4、Opus 4.6 对比。

    引用Qwen (@Alibaba_Qwen)@Alibaba_Qwen

    👏👏 Introducing Qwen3.7-Plus — a multimodal agent model that unifies vision and language into one versatile agent foundation. ✅ Multimodal interactive hybrid agent: unified GUI & CLI operation across visual and text tasks ✅ Versatile coding agent & productivity assistant with full-modality input ✅ Visual Agent: perception, reasoning, grounding, and search-augmented QA ✅ Cross-harness generalization across diverse agent frameworks One model. Sees, thinks, codes, acts.🙌🙌 Now available via API on Alibaba Cloud Model Studio. Try it — let us know what you build.😎 🔗🔗⬇️⬇️ Blog:qwen.ai/blog?id=qwen3.7-plus Qwen Studio:chat.qwen.ai/?models=qwen3.7… API:modelstudio.console.alibabac…

    推荐理由:官方把 Qwen3.7-Plus 与 GPT-5.4、Opus 4.6 并列对比,读者可据此观察多模态智能体模型的竞争位置。

  7. @kilocode67

    MiniMax 发布 M3 模型,官方称其为首个同时整合编程、Agent 与多模态三项前沿能力的开放权重模型。官方报告其在 SWE-Bench Pro 取得 59.0%、Terminal Bench 2.1 取得 66.0%、SWE-fficiency 取得 34.8%、KernelBench Hard 取得 28.8%、MCP Atlas 取得 74.2%,并通过 MiniMax Sparse Attention 将上下文扩展到 1M。模型从第一步起原生多模态,权重与技术报告预计约 10 天后发布,API 与 MiniMax Code 入口已开放。

    引用MiniMax (official) (@MiniMax_AI)@MiniMax_AI

    Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier: 59.0% SWE-Bench Pro, 66.0% Terminal Bench 2.1, 34.8% SWE-fficiency, 28.8% KernelBench Hard, 74.2% MCP Atlas - MiniMax Sparse Attention scales context to 1M - Natively Multimodal from Step Zero API: platform.minimax.io Token Plan: platform.minimax.io/subscrib… 🚀New! MiniMax Code: code.minimax.io Weights & Tech Report in ~10 Days

    推荐理由:官方给出 M3 的编程与 Agent 基准数据及 1M 上下文能力,可据此观察开源权重模型的前沿能力边界。

6月1日周一
  1. @kimmonismus74

    MiniMax 发布 M3 开放权重模型,在 SWE-Bench Pro 上得分 59%,略高于 GPT-5.5 的 58.6%,高于 Gemini 3.1 Pro 的 54.2%,编码上仍落后 Opus 4.7。该模型支持 1M token 上下文并原生多模态,在 BrowseComp 上以 83.5% 领先 Opus 4.7,每 token 成本约为 GPT-5.5 的 1/12。权重和完整技术报告预计约 10 天后发布。

    引用MiniMax (official) (@MiniMax_AI)@MiniMax_AI

    Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier: 59.0% SWE-Bench Pro, 66.0% Terminal Bench 2.1, 34.8% SWE-fficiency, 28.8% KernelBench Hard, 74.2% MCP Atlas - MiniMax Sparse Attention scales context to 1M - Natively Multimodal from Step Zero API: platform.minimax.io Token Plan: platform.minimax.io/subscrib… 🚀New! MiniMax Code: code.minimax.io Weights & Tech Report in ~10 Days

    推荐理由:原文给出了 M3 与 GPT-5.5、Opus 4.7 的基准对比和成本差距,读者可据此判断开放权重模型的能力位次。

  2. @PBDTokenRouter68

    MiniMax M3 现已在 PBD TokenRouter 上线,该开源权重模型同时具备编码与智能体能力。其在 SWE-Bench Pro 取得 59.0%、Terminal Bench 2.1 取得 66.0%、MCP Atlas 取得 74.2%,并借 MiniMax Sparse Attention 支持最高 1M token 上下文,且原生支持多模态。PBD 自 M2.7 起与 MiniMax 团队合作,用户可用同一密钥替换模型 ID 调用。

    推荐理由:原文列出 M3 的三项基准分数与 1M token 上下文,读者可据此比较其与同类开源模型的定位。

  3. @kimmonismus68

    Cosmos 3 发布 Nano(8B)和 Super(32B)两个规格,两者目前均已在 Hugging Face 上线。Nano 可在单张工作站 GPU 上运行实时机器人任务,Super 为数据中心级、追求最高质量。随模型还开放了六个数据集和完整的后训练脚本,位于 GitHub。

    推荐理由:Cosmos 3 以工作站单卡和数据中心两种规格发布,并配套开放数据集与后训练脚本,读者可据此判断机器人模型的部署取舍。

  4. @kimmonismus70

    Cosmos 3 在多个公开榜单登顶,成为 Artificial Analysis 文本生成图像和图像生成视频的开源模型第一名。它在 Physics-IQ 的物理准确性上超过 Sora 2,在 PAI-Bench 整体领先 Veo 3.1,并在 RoboArena 位列机器人策略第一。作者称其以开放权重在物理表现上超过闭源前沿视频模型。

    推荐理由:原文列出 Cosmos 3 在文本生成图像、图像生成视频等多个榜单的开源排名,可据此比较开源模型与闭源前沿模型的差距。

  5. @kimmonismus78

    NVIDIA 在 GTC Taipei 开源物理 AI 模型 Cosmos 3,作者称其为首个完全开放的 omnimodel,可理解现实世界、预测后续变化并生成机器人动作。该模型开放权重、代码与数据集,NVIDIA 同步发布 Super(32B)与 Nano(8B)两个版本。

    引用NVIDIA AI (@NVIDIAAI)@NVIDIAAI

    Introducing Cosmos 3: Our latest frontier model for Physical AI Cosmos 3 is the world’s first fully open omnimodel with native vision reasoning, world and action generation. Today we’re releasing Super (32B) and Nano (8B) variants. Video

    推荐理由:英伟达开源 Cosmos 3 的权重、代码与数据集,读者可了解物理 AI 全开放模型的两种规模与开放范围。

  6. @MiniMax_AI66

    MiniMax 发布 M3 模型。官方主推提到视频控制、游戏等场景,以及开源权重、超大上下文和强编码能力。引用评测 @MinLiBuilds 称 M3 有 1M context、原生多模态与 Agentic 三项特性,并用截图在多 agent 工作流下于 2 小时做出可运行的双人对决小游戏。

    引用实践哥MinLi (@MinLiBuilds)@MinLiBuilds

    跟祖传的 20K context 说 bye bye 了。 MiniMax M3 发布了,三个亮点: 1M context、原生多模态、Agentic。 我这次做了一次完整评测,使用CC workflow 、 @ZenMuxAI和MiniMax M3: 给一张截图,做一个“凡人修仙剑阵对决手势游戏”。 要求是:支持双人对决 、使用 workflow 拆解任务、加入石头剪刀布机制。 2 小时后,游戏真的跑起来了。 这一代LLM的版本答案我知道了: 1M 上下文 + 多模态+ agent 模式。 1M context 是推理深度的基础,多 agent 负责拆任务和执行。 Video

    推荐理由:官方给出 M3 的开源权重与大上下文等信息,引用评测展示了多模态加 Agent 工作流的实际产出。

  7. @MiniMax_AI66

    MiniMax M3 已在 Novita AI 上线,作为 Day-0 API 合作方开放,首周享 50% 折扣。Novita 称 M3 是首个同时具备前沿编码与智能体能力、最高 1M tokens 上下文和原生多模态的开源权重模型,其中上下文由 MiniMax Sparse Attention 实现,基准成绩为 59.0% SWE-Bench Pro、66.0% Terminal Bench 2.1、74.2% MCP Atlas。

    引用Novita AI (@novita_labs)@novita_labs

    🚀 We’re launching MiniMax M3 from @MiniMax_AI on Novita AI as a Day-0 API launch partner. The first open-weights model to combine: • Frontier coding and agent capabilities 59.0% SWE-Bench Pro, 66.0% Terminal Bench 2.1, 74.2% MCP Atlas • Up to 1M tokens of context Enabled by MiniMax Sparse Attention • Native multimodality from day one Built for both text and visual understanding Excited to make MiniMax M3 available to developers on Day 0. Video

    推荐理由:M3 在 Novita 上线并附上 SWE-Bench Pro 等基准,可据此了解其编码与智能体能力定位。

  8. @MiniMax_AI76

    MiniMax 宣布 M3 在 OrcaRouter 首日上线,首周使用可享 50% 折扣。引用信息显示,M3 支持最高 1M token 上下文(最低保证 512K),具备新一代稀疏注意力、更快推理和更强的智能体工作流,并称其为最受期待的开源模型发布之一。

    引用OrcaRouter 🐳 (@OrcaRouter)@OrcaRouter

    🚀 @MiniMax_AI M3 is now available on OrcaRouter. One of the most anticipated open model releases, bringing next-gen sparse attention, ultra-long context handling (up to 1M tokens of context with a guaranteed minimum of 512K), faster inference, and stronger agentic workflows. Try it out here: orcarouter.ai/models/minimax…

    推荐理由:MiniMax M3 首日上线 OrcaRouter,读者可据此了解其长上下文与智能体工作流的能力定位。

  9. @op741870

    MiniMax 发布大版本模型升级 MiniMax M3,标配 1M 超长上下文,采用新的 MSA(MoE with Segment-wise Attention)稀疏注意力架构,并从训练起融合文本、图片、视频和桌面操作的原生多模态能力。

    引用MiniMax (official) (@MiniMax_AI)@MiniMax_AI

    Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier: 59.0% SWE-Bench Pro, 66.0% Terminal Bench 2.1, 34.8% SWE-fficiency, 28.8% KernelBench Hard, 74.2% MCP Atlas - MiniMax Sparse Attention scales context to 1M - Natively Multimodal from Step Zero API: platform.minimax.io Token Plan: platform.minimax.io/subscrib… 🚀New! MiniMax Code: code.minimax.io Weights & Tech Report in ~10 Days

    推荐理由:MiniMax M3 标配 1M 上下文并采用新的稀疏注意力架构,读者可据此了解长上下文模型的算力成本变化。

  10. Hugging Face Blog80

    NVIDIA 发布 Cosmos 3:首个面向物理 AI 推理与动作的开源全模态模型

    NVIDIA 在 Hugging Face 上发布 Cosmos 3,这是一个面向物理 AI 的开源全模态模型。它基于 Mixture-of-Transformers 架构,将世界生成、物理推理与动作生成整合到单一模型中。

    推荐理由:NVIDIA 将世界生成、物理推理与动作生成整合到一个模型中,并给出开源模型与 Diffusers 接入方式。

  11. @MiniMax_AI69

    MiniMax 发布 M3,引用内容描述其为开放权重的前沿级模型,具备 1M 上下文窗口和图像、视频原生多模态能力。MiniMax 官方账号表示 M3 可与 visionagents_ai 结合用于实时语音与视频。

    引用Vision Agents (@visionagents_ai)@visionagents_ai

    Congrats to the @MiniMax_AI team on the release of M3! 👉 A frontier-class open-weight model 👉 1M context window 👉 Native multimodality (image & video)

    推荐理由:MiniMax M3 以开放权重、1M 上下文和原生多模态发布,读者可据此了解实时语音与视频的集成方向。

  12. @MiniMax_AI75

    MiniMax-M3 已在 Venice(@AskVenice)上线,作者称其开放权重,具备前沿编码与智能体能力,支持 1M 上下文和原生多模态,首日即可用并支持匿名访问。引用文案称其为首个兼具前沿编码与智能体性能并原生支持多模态的开放权重模型,面向长周期复杂工作流。

    引用Venice (@AskVenice)@AskVenice

    MiniMax-M3 by @MiniMax_AI is now live on Venice. The first open-weight model to deliver frontier coding and agentic performance with native multimodality. Built for long-horizon, complex workflows. Available anonymously.

    推荐理由:MiniMax-M3 以开放权重同时具备前沿编码与智能体能力,支持 1M 上下文和原生多模态,面向长周期复杂工作流。

  13. @MiniMax_AI71

    MiniMax 发布 M3 模型,并在发布当天同步上线 OpenRouter。该模型具备 1M token 上下文窗口、前沿编码与智能体能力,以及原生多模态,首周提供 50% 折扣。OpenRouter 称其为前沿级开源权重模型,原生多模态覆盖图像与视频。

    引用OpenRouter (@OpenRouter)@OpenRouter

    MiniMax-M3 is live on OpenRouter! A frontier-class open-weight model that combines a 1M-token context window, frontier coding and agentic performance, and native multimodality (image & video) in one model.

    推荐理由:MiniMax-M3 上线 OpenRouter 并给出首周折扣,可了解其 1M 上下文与多模态能力的组合方式。