跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

当前仅显示精选新闻
530条精选相关主题产品更新论文研究开源生态

最新精选

第 481–500 条 · 共 530 条
5月15日周五
  1. Hugging Face Blog63

    IBM 发布 Granite Embedding Multilingual R2 多语言嵌入模型,支持 32K 上下文

    IBM 发布两个 Apache 2.0 多语言嵌入模型 granite-embedding-97m-multilingual-r2 和 granite-embedding-311m-multilingual-r2,基于 ModernBERT,覆盖 200+ 语言、32K token 上下文,并支持 9 种编程语言的代码检索。

    推荐理由:两个模型以 Apache 2.0 覆盖 200+ 语言和 32K 上下文,读者可对照基准表判断小模型在多语言检索上的实际取舍。

5月9日周六
  1. Hugging Face Blog65

    AI2 发布 EMO:预训练混合专家实现涌现模块化

    AI2 发布 EMO,一个 1B 激活、14B 总参数(8 专家激活、128 专家总量)的混合专家模型,在 1 万亿 token 上端到端预训练,让模块化结构直接从数据中涌现。保留 25% 专家时各基准平均性能只下降约 1%,仅保留 12.5% 专家时平均下降约 3%,而同等架构的标准 MoE 在相同子集设置下明显退化。团队同时开源了 EMO 模型、同等数据的标准 MoE 基线和训练代码。

    推荐理由:EMO 让专家子集按语义领域自然分组,只保留 12.5% 专家仍接近全模型性能,为稀疏 MoE 的部署取舍提供参考。

5月8日周五
  1. @diegocabezas0166

    OpenAI 将新语音模型 gpt-realtime-2 上线 API,开发者 @diegocabezas01 发布了自建演示。被引用的 @sama 表示,人们正越来越多地用语音与 AI 交互,尤其是在需要输入大量上下文的场景,并称这是相当大的一步进展,同时提到团队正在改进聊天中的语音体验。

    引用Sam Altman (@sama)@sama

    people are really starting to use voice to interact with AI, especially when they have a lot of context to dump. GPT-Realtime-2 comes to the API today; it is a pretty big step forward. (we are working on improvements to voice in chat.)

    推荐理由:OpenAI 把 gpt-realtime-2 语音模型带进 API,并附开发者自建演示,可据此了解语音交互的使用场景。

5月5日周二
  1. OpenAI News75

    OpenAI 发布 GPT-5.5 Instant 系统卡

    OpenAI 发布 GPT-5.5 Instant 系统卡,说明这款最新 Instant 模型沿用系列安全缓解方案。这是首款在网络安全与生物化学预备类别中被按高能力模型处理并实施相应保障的 Instant 模型,基线对比对象为 GPT-5.3 Instant。卡片还注明不存在 GPT-5.4 Instant,并把 GPT-5.5 称为 GPT-5.5 Thinking 以避免混淆。

    推荐理由:系统卡交代 GPT-5.5 Instant 沿用系列安全缓解方案,并首次把 Instant 模型在网络安全与生物化学预备类别按高能力处理。

5月1日周五
  1. @CalmPromptsHQ69

    SenseTime 将 SenseNova U1 Lite 系列开源,该系列基于 NEO-unify 架构,原生统一多模态理解与生成,提供 8B 和 A3B 两个紧凑版本。官方称其在开源模型中效率领先,并用单一模型单流生成交错的文本与图像,面向指南、知识插图、海报、PPT、漫画等信息密集版式。模型权重已在 Hugging Face 和 GitHub 发布,并可自托管。

    引用SenseTime (@SenseTime_AI)@SenseTime_AI

    𝗦𝗲𝗻𝘀𝗲𝗡𝗼𝘃𝗮 𝗨1 𝗟𝗶𝘁𝗲 𝗦𝗲𝗿𝗶𝗲𝘀 𝗶𝘀 𝗻𝗼𝘄 𝗼𝗽𝗲𝗻 𝘀𝗼𝘂𝗿𝗰𝗲! Built on the 𝗡𝗘𝗢-𝘂𝗻𝗶𝗳𝘆 𝗮𝗿𝗰𝗵𝗶𝘁𝗲𝗰𝘁𝘂𝗿𝗲, it natively unifies multimodal understanding and generation, delivering: •𝗦𝗢𝗧𝗔 𝗘𝗳𝗳𝗶𝗰𝗶𝗲𝗻𝗰𝘆 𝗔𝗺𝗼𝗻𝗴 𝗢𝗽𝗲𝗻-𝗦𝗼𝘂𝗿𝗰𝗲 𝗠𝗼𝗱𝗲𝗹𝘀: Compact models (8B & A3B) delivering commercial-grade performance and exceptional cost efficiency. Leading performance among open-source models across a wide range of understanding, reasoning, and generation benchmarks. •𝗡𝗮𝘁𝗶𝘃𝗲 𝗜𝗺𝗮𝗴𝗲–𝗧𝗲𝘅𝘁 𝗜𝗻𝘁𝗲𝗿𝗹𝗲𝗮𝘃𝗲𝗱 𝗚𝗲𝗻𝗲𝗿𝗮𝘁𝗶𝗼𝗻: Generate coherent interleaved text and images in a single flow using one model; ideal for practical applications like guides, where visuals turn complex information into intuitive insights. •𝗛𝗶𝗴𝗵-𝗗𝗲𝗻𝘀𝗶𝘁𝘆 𝗜𝗻𝗳𝗼𝗿𝗺𝗮𝘁𝗶𝗼𝗻 𝗥𝗲𝗻𝗱𝗲𝗿𝗶𝗻𝗴: Strong capabilities in dense visual communication, generating richly structured layouts for knowledge illustrations, posters, PPTs, comics and other information-rich formats. 𝗛𝘂𝗴𝗴𝗶𝗻𝗴 𝗙𝗮𝗰𝗲: huggingface.co/collections/s… 𝗚𝗶𝘁𝗛𝘂𝗯: github.com/OpenSenseNova/Sen… 𝗗𝗶𝘀𝗰𝗼𝗿𝗱: discord.gg/cxkwXWjp  @huggingface @github

    推荐理由:SenseNova U1 Lite 以 8B、A3B 紧凑规模开源权重,读者可据此衡量自托管图文版式生成的成本门槛。

4月29日周三
  1. @TencentHunyuan66

    腾讯混元开源 Hy-MT1.5-1.8B-1.25bit 翻译模型,该模型仅 440MB,可在手机完全离线运行,支持 33 种语言。1.8B 参数在标准基准上匹配商业翻译 API 和 235B 规模模型,量化到 1.25-bit 后内存从 3.3GB(FP16)降至 440MB,比之前 1.67-bit 方案小 25%、快约 10%,且无精度损失。

    推荐理由:1.8B 翻译模型量化到 1.25bit 后仅 440MB,可在手机离线运行,为端侧模型压缩提供参考。

4月28日周二
4月24日周五
  1. 歸藏的AI工具箱 · 微信公众号76

    DeepSeek V4 发布 Flash 与 Pro 两个型号

    DeepSeek V4 发布,包含 Flash 和 Pro 两个型号,支持 JSON 输出、工具调用、对话前缀续写和 FIM 补全。Flash 每百万输入/输出价格为 ¥0.2 和 ¥1,Pro 为 ¥1 和 ¥12,100 万上下文的输出价格翻倍,详情见 api-docs.deepseek.com/zh-cn/quick_start/pricing。

    推荐理由:原文汇总了两个型号的功能支持与每百万输入输出价格,读者可据此对比选型和使用成本。

  2. @TencentHunyuan66

    腾讯混元宣布 Hy3-Preview 已在 OpenRouter 上线,5 月 8 日前可免费试用。据 OpenRouter 介绍,该模型为 295B MoE 架构(21B 激活参数),支持可控推理强度,在编码智能体场景表现较强并具备全面通用能力。

    引用OpenRouter (@OpenRouter)@OpenRouter

    The new Hy3-Preview model from @TencentHunyuan is live for free on OpenRouter! It’s a 295B MoE model (21B active) with controllable reasoning effort. A cost-effective, practical model that performs strongly in coding agents and delivers comprehensive general capabilities.

    推荐理由:腾讯混元 Hy3-Preview 上线 OpenRouter 并限时免费,读者可了解其 MoE 规模与可控推理强度设定。

4月23日周四
  1. OpenAI News79

    OpenAI 发布 GPT-5.5 系统卡

    OpenAI 发布 GPT-5.5 系统卡,介绍该模型面向写代码、在线研究、分析信息、创建文档与表格等复杂实际工作,并能跨工具完成任务。系统卡披露了预部署安全评估和 Preparedness Framework 下的针对性红队测试,覆盖高级网络安全与生物能力,并在发布前收集了近 200 家早期访问伙伴的反馈。

    推荐理由:系统卡列出 GPT-5.5 的预部署安全评估、针对性红队测试和近 200 家早期访问伙伴的反馈,读者可据此了解其发布前的安全审查流程。