跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

当前仅显示精选新闻
574条精选相关主题产品更新论文研究开源生态

最新精选

第 301–320 条 · 共 574 条
7月31日周五
  1. ByteDance Seed Research73

    字节 Seed 发布视频生成模型 Seedance 2.5

    ByteDance Seed 正式发布视频生成模型 Seedance 2.5,延续 Seedance 2.0 的多模态音视频联合生成架构,单次生成时长从 15 秒提升至 30 秒并支持多轮延长,可生成数分钟连贯内容。

    推荐理由:官方公布单次生成 30 秒、30 张图参考和时间戳编辑等具体能力变化与上线入口,读者可据此评估视频创作工作流。

7月30日周四
  1. Google DeepMind67

    Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型,新增视频理解与多机器人协作

    Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型,可通过连续视频流追踪任务进度、编排多步任务,并支持多机器人协作,将运动执行交给下层 VLA 模型。

    推荐理由:官方公布具身推理模型的能力指标与 API 入口,开发者可以据此评估它在实体机器人任务编排中的可用性。

7月28日周二
  1. Google DeepMind71

    Google DeepMind 发布 Gemini Robotics 2,实现机器人全身智能控制

    Google DeepMind 发布 Gemini Robotics 2 系列模型,包含 VLA 模型 Gemini Robotics 2、具身推理模型 Gemini Robotics ER 2 和可本地运行的 Gemini Robotics On-Device 2,实现人形机器人全身控制、精细操作和多机器人协作。

    推荐理由:官方完整说明了三个模型的能力分工、适配速度和安全基准,读者可了解机器人全身体智能的最新进展与获取方式。

  2. AI科技评论 · 微信公众号86

    Kimi K3 发布开放权重与 47 页技术报告,披露三项核心架构改动

    Kimi K3 发布开放权重并公开 47 页技术报告,包含 2.8T 总参数、104B 激活参数和 100 万 token 上下文。报告重点在 KDA、AttnRes 与 Stable LatentMoE 三项架构改动,分别处理模型变长、变深、变宽后的信息流问题。

    推荐理由:技术报告披露的 KDA、AttnRes 与 LatentMoE 三项架构改动,可帮读者理解长上下文和长程 Agent 训练的工程取舍。

  3. InfoQ · 微信公众号76

    月之暗面开源 Kimi K3 权重,Anthropic 称从未主张禁止开放权重模型

    月之暗面于 7 月 27 日晚开放 Kimi K3 的模型权重、技术报告和关键 Infra 技术,Anthropic 联合创始人兼 CEO Dario Amodei 随后发文回应称,Anthropic 从未主张禁止开放权重模型。

    推荐理由:材料把 K3 开源所需的千万级硬件门槛与开放权重政策争论并置,读者可据此判断开源模型的实际使用边界。

  4. AI寒武纪 · 微信公众号84

    Kimi K3 正式开源,2.8 万亿参数技术报告公布核心架构改动

    月之暗面正式开源 Kimi K3,参数量 2.8 万亿、激活参数 1040 亿,支持 100 万 token 上下文并具备原生视觉理解,同步发布技术报告。

    推荐理由:技术报告公开了注意力、跨层残差与 MoE 负载均衡的具体改动,可借此看清单个开源模型在万亿参数规模上的工程取舍。

7月27日周一
7月25日周六
  1. Simon Willison77

    Anthropic 发布 Claude Opus 5

    Anthropic 发布 Claude Opus 5,定价与 Opus 4.8 相同,并继续提供价格为基础模型两倍的 fast mode。发布帖提到,它在某个 Frontier-Bench 任务中无法直接查看图纸,于是自建计算机视觉流程,从原始像素中提取几何并重建出完整零件;它在发现安全漏洞方面接近 Mythos 5,但利用漏洞的能力仍明显落后,因为未被训练相关攻击任务。

    推荐理由:文中援引发布帖里的零件重建案例,呈现了模型在缺少直接视图时自行搭建视觉流程的过程。

7月24日周五