跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

178条精选相关主题产品更新论文研究开源生态

最新精选

第 141–160 条 · 共 178 条
4月28日周二
  1. inclusionAI Hugging Face models62

    inclusionAI 发布 DR-Venus-4B-SFT 深度研究智能体模型

    inclusionAI 发布 4B 深度研究智能体 DR-Venus-4B-SFT,基于 Qwen3-4B-Thinking-2507 在清洗后的开源 REDSearcher 轨迹上做智能体监督微调,最大训练长度 200K,使用 search 与 visit 工具。

    推荐理由:给出 9B 以下开源深研究智能体的基准对比,读者可据此判断 4B 模型的深研究能力位置。

4月24日周五
  1. 微信公众号(Mp2RSS 合集)76

    DeepSeek V4 发布 Flash 与 Pro 两个型号

    DeepSeek V4 发布,包含 Flash 和 Pro 两个型号,支持 JSON 输出、工具调用、对话前缀续写和 FIM 补全。Flash 每百万输入/输出价格为 ¥0.2 和 ¥1,Pro 为 ¥1 和 ¥12,100 万上下文的输出价格翻倍,详情见 api-docs.deepseek.com/zh-cn/quick_start/pricing。

    推荐理由:原文汇总了两个型号的功能支持与每百万输入输出价格,读者可据此对比选型和使用成本。

  2. @TencentHunyuan66

    腾讯混元宣布 Hy3-Preview 已在 OpenRouter 上线,5 月 8 日前可免费试用。据 OpenRouter 介绍,该模型为 295B MoE 架构(21B 激活参数),支持可控推理强度,在编码智能体场景表现较强并具备全面通用能力。

    引用OpenRouter (@OpenRouter)@OpenRouter

    The new Hy3-Preview model from @TencentHunyuan is live for free on OpenRouter! It’s a 295B MoE model (21B active) with controllable reasoning effort. A cost-effective, practical model that performs strongly in coding agents and delivers comprehensive general capabilities.

    推荐理由:腾讯混元 Hy3-Preview 上线 OpenRouter 并限时免费,读者可了解其 MoE 规模与可控推理强度设定。

  3. DeepSeek API updates76

    DeepSeek API 上线 DeepSeek-V4-Pro 与 V4-Flash

    DeepSeek API 已支持 V4-Pro 与 V4-Flash,兼容 OpenAI ChatCompletions 接口与 Anthropic 接口,base_url 不变,model 参数改为 deepseek-v4-pro 或 deepseek-v4-flash。

    推荐理由:官方说明了新模型接入方式与旧模型名停用时间,开发者可以据此安排迁移。

4月23日周四
  1. OpenAI News79

    OpenAI 发布 GPT-5.5 系统卡

    OpenAI 发布 GPT-5.5 系统卡,介绍该模型面向写代码、在线研究、分析信息、创建文档与表格等复杂实际工作,并能跨工具完成任务。系统卡披露了预部署安全评估和 Preparedness Framework 下的针对性红队测试,覆盖高级网络安全与生物能力,并在发布前收集了近 200 家早期访问伙伴的反馈。

    推荐理由:系统卡列出 GPT-5.5 的预部署安全评估、针对性红队测试和近 200 家早期访问伙伴的反馈,读者可据此了解其发布前的安全审查流程。

4月16日周四
  1. Claude Platform release notes84

    Anthropic 发布 Claude Opus 4.7,维持 $5/$25 定价并引入 task budgets 与高分辨率图像输入

    Anthropic 发布 Claude Opus 4.7,定位复杂推理与智能体编码,定价维持 $5/$25 per MTok,与 Opus 4.6 相比存在 API 破坏性变更并需参考迁移指南。

    推荐理由:原文列出定价、API 破坏性变更、task budgets 与高分辨率图像等具体变化,升级前可据此排查迁移成本。

4月13日周一
4月2日周四
3月24日周二
  1. Mistral AI66

    Mistral AI 发布首个语音合成模型 Voxtral TTS

    Mistral AI 发布 4B 参数的文本转语音模型 Voxtral TTS,支持英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语 9 种语言,API 定价 $0.016 per 1k characters。

    推荐理由:官方给出了与 ElevenLabs 对比的人类评测数据和低延迟指标,读者可据此评估其在语音 Agent 场景的可用性。

3月20日周五
3月17日周二
2月5日周四
  1. Mistral AI64

    Mistral 发布 Voxtral Transcribe 2 语音转写模型,Realtime 开放权重

    Mistral 发布 Voxtral Transcribe 2 系列,包含 Voxtral Mini Transcribe V2(批量转写)和 Voxtral Realtime(实时转写),支持 13 种语言的说话人分离、上下文偏置和词级时间戳。

    推荐理由:官方给出了两个语音转写模型的具体延迟、错误率和价格,并开放了 Voxtral Realtime 权重,便于按场景选型。

12月17日周三
12月9日周二
  1. Mistral AI76

    Mistral 发布 Devstral 2(123B)与 Devstral Small 2(24B)开源编码模型及 Vibe CLI

    Mistral 发布开源编码模型 Devstral 2(123B,修改版 MIT)和 Devstral Small 2(24B,Apache 2.0),SWE-bench Verified 分别达 72.2% 和 68.0%,均支持 256K 上下文。

    推荐理由:官方给出了两个尺寸的开源编码模型参数量、SWE-bench Verified 成绩、API 定价和部署门槛,可与闭源竞品直接对比。

12月3日周三
  1. Mistral AI77

    Mistral 发布 Mistral 3 系列模型,含 Mistral Large 3 与 Ministral 3,均以 Apache 2.0 开源

    Mistral 发布新一代模型系列 Mistral 3,包括 14B/8B/3B 的 Ministral 3 小模型和 sparse MoE 架构的 Mistral Large 3(41B 激活、675B 总参数),全部以 Apache 2.0 许可开源,提供 base、instruct 和 reasoning 变体。

    推荐理由:官方公布完整模型规格、开源许可和部署路径,读者可据此评估在自建或端侧场景的可用性。

12月1日周一
  1. DeepSeek API updates69

    DeepSeek-V3.2-Speciale 开放非正式 API 访问,截止 2025-12-15

    DeepSeek 非正式部署 DeepSeek-V3.2-Speciale API 服务,用户通过 base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215" 访问。价格不变,仅支持思考模式下的对话功能,不支持工具调用,最大输出长度默认 128K,支持至北京时间 2025-12-15 23:59。

    推荐理由:原文给出了非正式部署的访问方式和明确截止时间,用户可以据此判断是否短期试用这个思考模式模型。