跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

当前仅显示精选新闻
416条精选相关主题模型发布行业动态AI 编码

最新精选

第 101–120 条 · 共 416 条
9月4日周五
9月3日周四
  1. Google DeepMind72

    Google DeepMind 发布 WeatherNext 3 全球 AI 天气模型

    Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为最先进准确的全球 AI 天气模型。模型直接学习实时卫星数据和气象站观测,逐小时产出最高 5 公里分辨率预报,精度约为 WeatherNext 2 的五倍;中期降水预报 CRPS 相对 IMERG 提升最高 60%。

    推荐理由:官方介绍了新模型的分辨率、逐小时更新和降水精度提升,并说明其在 Google 各产品中的落地方式,读者可评估对天气相关业务的应用价值。

  2. @bcherny66

    Claude Cowork 和 Claude Code 新增后台电脑使用功能,Claude 可以像用户一样在桌面点击、输入并打开应用,同时用戶可以处理别的事情。Boris Cherny 转发该消息并评论称,后台电脑使用这一能力被低估。

    引用@claudeai@claudeai

    Claude can now use your computer in the background in Claude Cowork and Claude Code. Give it something to do on your desktop and Claude clicks, types, and opens apps just like you would, while you work on something else. https://t.co/AOiup03pQK

    推荐理由:引用内容给出了在后台操作桌面应用的具体能力边界,作者补充指出这一能力被低估。

  3. Hugging Face Blog69

    Hugging Face 发布开源工具 funes,为编码 Agent 提供本地自有记忆层

    Hugging Face 发布开源工具 funes,把机器上已有的 Agent 会话记录变成可检索的记忆层,一条 funes add 命令即可接入 Claude Code、Codex、pi 和 Hermes。

    推荐理由:原文给出 funes 的本地检索管线、跨机器同步与 token 成本对比数据,读者可以据此判断它能否改善多机多 Agent 的工作流。

  4. @claudeai77

    Claude 现在可在 Claude Cowork 和 Claude Code 中后台使用电脑,用户给桌面任务后,Claude 会像用户一样点击、输入并打开应用,同时用户可以处理其他事情。官方展示的授权界面显示,电脑使用需要用户批准,允许 Claude 在后台或完全控制屏幕的情况下查看和操作已批准的应用。

    推荐理由:官方说明 Claude Cowork 和 Claude Code 能在后台操作电脑,并展示了应用授权入口,读者可据此判断这类电脑操作智能体的可用边界。

  5. Claude Blog63

    Anthropic 发布 Claude 商务智能体蓝图,含购物与商家智能体参考实现

    Anthropic 发布用于构建 commerce agents 的蓝图,包含让工程团队在数天内跑起商务智能体所需的 harness、模式与护栏,并提供零售、旅行、电信和票务场景的购物智能体与商家智能体参考实现。

    推荐理由:Anthropic 公开 commerce agents 蓝图与参考实现,开发者可据此判断商务智能体的落地路径与部署选择。

9月2日周三
  1. Cursor Blog72

    Cursor 发布自托管机器,云端智能体可在自有基础设施上运行

    Cursor 发布自托管机器功能,云端智能体可以运行在团队自管的机器资源池上,智能体循环、推理与规划仍留在 Cursor 云端。工具执行则转移到自有环境中的机器:安装 Cursor CLI 并运行 agent worker start 建立通往 Cursor 云端的出站 HTTPS 长连接,Cursor 从不主动向用户网络发起连接。

    推荐理由:自托管机器把工具执行环境交回团队自有基础设施,推理与编排仍留在 Cursor 云端,读者可据此判断适用边界。

  2. @GoogleDeepMind67

    Gemini 的智能体视频理解开始在 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上通过 Google AI Studio 的 API 推送,并即将登陆 Gemini App。该能力不再扫描整个文件,而是跨视频字幕、音频和画面做推理,动态调整帧率以定位所需片段,长视频内容(从 10 分钟指南到数小时录像)的效率提升最明显。官方图表显示,在 1H-VideoQA 与 LVBench 等长视频基准上,单次查询 token 从约 30 万至 40 万降至 5 万以内,准确率同步小幅上升。

    推荐理由:官方图表给出长视频场景 token 消耗大幅下降而准确率上升的对比,读者可据此判断长视频处理的成本空间。

  3. Google DeepMind68

    Google DeepMind 为 Gemini 推出 agentic video understanding 视频分析功能

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic video understanding,动态检索视频片段以替代固定帧率处理,token 消耗最多降 88%,成本最多降 66%,准确率最多提升 7%。

    推荐理由:官方给出 token、成本与准确率的具体降幅和开启方式,长视频处理场景下可评估是否切换处理模式。

  4. Artificial Intelligence News76

    ChatGPT Ads 200 天年化收入达 10 亿美元,自助投放扩展至印度欧洲等地区

    ChatGPT Ads 上线不到 200 天,年化收入运行率达到 10 亿美元,OpenAI 同时将 Ads Manager 自助投放扩展至印度、欧洲、中东和北非,当地企业可直接开户投放,无需先经过管理销售团队或代理伙伴。

    推荐理由:原文给出广告收入规模与自助投放新开放的地区,可以观察 ChatGPT 广告产品线的商业化节奏与区域扩张路径。

9月1日周二
  1. @rohanpaul_ai68

    Meta 的 Muse Code 结束 beta,并开放可编程能力,新 SDK 让开发者可在 Muse 的会话、工具、权限和持久状态之上构建自己的 agent 与应用。工作流可并行协调多个子智能体,跨会话消息让多个相互独立的编码任务彼此协调,而非各自孤立。rewind 功能可回退到会话中较早的安全点,同时撤销该点之后的代码改动和对话状态。

    原始视频预览图;未保存可播放视频URL
    引用@finkd@finkd

    Muse Code is out of beta and now built to handle bigger, more complex engineering tasks. Developers can get started with one command today: curl -fsSL https://t.co/0RApZrEJMv | bash

    推荐理由:原文梳理了 Muse Code 的 SDK、多子智能体并行与 rewind 回退机制,可据此判断其作为编码智能体运行时的协作与容错能力。