跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

当前仅显示精选新闻
427条精选相关主题模型发布行业动态AI 编码

最新精选

第 241–260 条 · 共 427 条
7月10日周五
  1. IT Home76

    OpenAI 推出 ChatGPT Work 智能体,由 GPT-5.6 支持面向长时多步骤任务

    OpenAI 推出 ChatGPT Work 智能体,由 GPT-5.6 提供支持,定位为可承担长时、多步骤任务的智能体。该智能体即日起在 ChatGPT 网页端和移动端向 Pro、Enterprise 和 Edu 用户开放,Plus 和 Business 将在未来几天推出。OpenAI 称 Codex 每周用户数已超过 500 万,其中超 100 万人将其用于软件开发之外的工作。

    推荐理由:OpenAI 把智能体能力从编码扩展到销售和财务,案例给出流程从数周缩短到 24 小时的具体参照。

7月9日周四
7月8日周三
  1. Hugging Face Blog64

    Hugging Face:vLLM 的 transformers 后端达到原生实现速度

    Hugging Face 宣布 vLLM 的 transformers modeling backend 现在在多种 LLM 架构上达到甚至超过 vLLM 手写原生实现的速度,模型作者无需移植即可获得原生推理性能。

    推荐理由:官方给出三种 Qwen3 规模下的对比数据和方法,读者可以据此评估是否直接用 transformers 后端替代手写 vLLM 实现。

7月7日周二
  1. Hugging Face Blog61

    Microsoft Foundry Managed Compute 上线 Hugging Face 精选模型集

    Microsoft 在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集,精选开源权重模型每周更新,可一键部署到 Azure 预置的 GPU 托管平台。

    推荐理由:官方详解 Hugging Face 模型进入 Foundry Managed Compute 的策展流程、支持运行时和部署方式,读者可以据此评估企业侧部署开源模型的实际路径。

  2. Hugging Face Blog61

    LeRobot v0.6.0 发布:世界模型策略、奖励模型 API 与六大仿真基准

    Hugging Face LeRobot 团队发布 v0.6.0,引入 VLA-JEPA、LingBot-VA、FastWAM 三个世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1 等 VLA,以及 Robometer、TOPReward 奖励模型和统一奖励 API。

    推荐理由:官方完整发布说明覆盖世界模型策略、奖励模型、基准与部署 CLI,读者可据此评估是否升级自己的机器人训练工作流。

  3. Hugging Face Blog63

    Hugging Face 与 SkyPilot 推出 store: hf,跨云读取 Hub 数据免出流费

    Hugging Face 与 SkyPilot 联合推出 store: hf 后端,用一个 hf:// URL 和现有 HF_TOKEN 即可将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,任务可调度到 20+ 云、Kubernetes 和本地集群。

    推荐理由:原文给出具体价格对比和三云基准数字,读者可以据此评估零出流存储对跨云训练成本的实际影响。

7月1日周三
  1. Claude Code GitHub Releases85

    Claude Code v2.1.197 更新,Claude Sonnet 5 成为默认模型

    Claude Code v2.1.197 引入 Claude Sonnet 5 并设为默认模型,提供原生 1M-token 上下文窗口。8 月 31 日前提供 $2/$10 每百万 token 的促销价,需更新到该版本才能使用。

    推荐理由:原文给出了 Claude Code 默认模型切换到 Claude Sonnet 5 的关键细节和限时定价,读者可据此评估是否升级版本。

6月30日周二
  1. Gemini API 更新日志62

    Gemini API 发布 gemini-omni-flash-preview 公测并将 Nano Banana 2 Lite 转正

    Google 在 Gemini API 更新日志中发布 gemini-omni-flash-preview 公开预览版,面向高速视频生成和对话式视频编辑,可通过 Interactions API 从文本生成 720p 的 3-10 秒视频,或让静态图片动起来,并支持对话式编辑输出。

    推荐理由:官方更新日志同时给出模型入口和生成参数,开发者可以据此评估视频与图像能力的接入方式。

6月29日周一
6月25日周四
  1. InfoQ · 微信公众号77

    OpenAI 与博通展示首款定制 AI 芯片 Jalapeño

    OpenAI 与博通联合打造的首款定制 AI 芯片 Jalapeño 正式展示,博通 CEO Hock Tan 称其性能可媲美英伟达 Blackwell 或谷歌 TPU,OpenAI 计划今年年底前部署,从初始设计到流片仅用九个月。

    推荐理由:呈现 OpenAI 与博通定制推理芯片的落地细节,以及训练与推理基础设施走向分化的路线差异。

  2. 硅星人Pro · 微信公众号82

    OpenAI 发布首款自研推理芯片 Jalapeño,九个月完成设计到流片

    OpenAI 发布首款自研芯片 Jalapeño,这是一款专为大模型推理设计的智能处理器,从最初设计到流片只用了九个月。OpenAI 负责从零设计芯片架构,博通负责芯片实现、网络和大规模量产,Celestica 负责板卡、机架与系统组装。OpenAI 称早期测试中每瓦性能将大幅优于当前业界最强水平,详细技术报告将在几个月后发布,芯片计划 2026 年底开始部署。

    推荐理由:文章交代了 OpenAI 首款自研推理芯片的九个月开发周期以及与博通、Celestica 的分工,可供判断其全栈基础设施布局。

  3. Hugging Face Blog65

    NVIDIA NeMo AutoModel 开源库发布,MoE 微调吞吐提升 3.4 至 3.7 倍

    NVIDIA 发布 NeMo AutoModel 开源库,基于 Transformers v5,在 Qwen3-30B-A3B 和 Nemotron 3 Nano 30B A3B 微调中实现 3.4 至 3.7 倍训练吞吐提升与 29% 至 32% 显存下降,只需改动一行 import。

    推荐理由:只需改动一行 import,MoE 微调吞吐即可提升 3.4 至 3.7 倍、显存降低 29% 至 32%,读者可据此判断迁移成本。

6月24日周三
  1. AI寒武纪 · 微信公众号81

    OpenAI与博通联合发布自研AI推理芯片Jalapeño,计划2026年底开始吉瓦级部署

    OpenAI与博通联合发布自研AI推理芯片Jalapeño,这是OpenAI第一颗自研智能处理器,从最初设计到制造流片用时九个月。工程样品已在实验室以量产目标频率和功耗稳定运行ML工作负载,其中包括GPT-5.3-Codex-Spark,早期测试显示其每瓦性能将大幅优于当前最先进水平。Jalapeño计划于2026年底开始初步部署,并与微软等合作伙伴共同推进吉瓦级数据中心。

    推荐理由:原文交代了OpenAI自研推理芯片的架构取向、合作分工与部署节奏,读者可据此理解其全栈基础设施布局。

  2. Gemini API 更新日志63

    Gemini API 为 Gemini 3.5 Flash 推出 Computer Use 工具公开预览

    Gemini API 为 Gemini 3.5 Flash 推出 Computer Use 工具公开预览,支持基于 intents 的简化操作。内置浏览器、移动端和桌面环境支持,并提供可配置安全策略和高级 prompt injection 检测。

    推荐理由:官方日志列出 Computer Use 工具的-preview 能力清单,读者可以对照现有 Gemini 自动化方案评估迁移成本。

6月23日周二
6月18日周四
  1. IT Home78

    华为昇腾 0 Day 支持智谱 GLM-5.2 模型,提供全面推理优化

    昇腾 0 Day 支持智谱 GLM-5.2,为编程与长程任务提供全面推理优化,A3 系列产品已支持单双机及大 EP 推理部署。官方围绕 MoE 大融合算子、通信与计算融合、多 Token 预测、高并发调度、智能缓存以及 PD 分离与 Prefix Cache 等关键技术做推理优化。GLM-5.2 于 6 月 17 日上线并开源,已在 Day 0 完成与华为昇腾等国产算力平台的推理适配。

    推荐理由:原文列出昇腾针对 GLM-5.2 的多项推理优化技术,读者可了解国产算力平台适配长上下文模型的工程路径。