跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

当前仅显示精选新闻
427条精选相关主题模型发布行业动态AI 编码

最新精选

第 141–160 条 · 共 427 条
8月26日周三
  1. Claude Blog72

    Claude 记忆功能打通聊天与 Cowork,支持逐条查看和编辑

    Claude 将聊天与 Claude Cowork 的记忆统一为同一份,在网页、桌面和移动端都从已积累的上下文开始工作。记忆改为在对话过程中实时添加,用户可在 Memory 设置的 Topics 列表里逐条查看、编辑或删除,并可随时暂停或重置。

    推荐理由:聊天与 Cowork 共用同一份记忆并支持逐条编辑,读者可了解记忆可控性的具体设计。

  2. Claude Blog73

    Claude Cowork 桌面端内置浏览器上线

    Anthropic 在 Claude Cowork 桌面应用中内置浏览器,Claude 可自主导航网页、阅读、点击、填表,本周起向 Pro、Max 和 Team 计划推送,Enterprise 管理员即日起可开启。

    推荐理由:官方说明了内置浏览器与 Claude in Chrome 的分工、登录方式和安全边界,读者可据此判断网页类任务该交给哪条路径。

8月25日周二
  1. @kimmonismus71

    OpenAI 称其首款自研推理芯片 Jalapeño 在速度和能效上超过 Nvidia GB200 与 GB300 系统。据 InferenceX 测试,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,该芯片峰值吞吐下每瓦 AI 算力提升 1.5–1.9×,端到端延迟降低 1.7–3.6×,高交互负载性能提升 2.1–4.1×。

    推荐理由:OpenAI 自研推理芯片的对比测试数据与 2026 年底部署计划一并给出,可据此了解其硬件自研路线的进展。

  2. Hugging Face Blog69

    Gradio 推出 gr.Workflow:把 AI 管线变成可拖拽、可部署的节点图

    Hugging Face 在 Gradio 中内置 gr.Workflow,将 AI 应用管线描述为带类型的节点图,在同一画布上提供可运行节点、可视化中间结果、REST API 和一键部署到 Hugging Face Spaces。

    推荐理由:官方介绍了 gr.Workflow 的节点图机制和多条可复制的示例工作流,读者可以据此评估它能否替代手工拼装 Python 管线。

8月22日周六
  1. @OpenRouter65

    OpenRouter 说明 Thinking Machines Lab 模型的提示词和输出会被记录并用于改进其模型,会话数据会先与账号解绑,完整条款见各模型页面。开放权重采用 Apache 2.0,通过 API 访问这些免费端点适用单独条款。

    推荐理由:原文说明这些免费端点的提示词与输出会被记录用于改进模型,开放权重为 Apache 2.0,读者可据此判断数据与授权条款。

8月21日周五
  1. @thsottiaux74

    OpenAI 的 Codex 本周活跃用户达到 2000 万,官方将给每位 Codex 和 ChatGPT Work 用户发放一次可自行安排使用的 banked reset。

    引用@thsottiaux@thsottiaux

    We've investigated a few messages about codex usage limits being different. That's not something we change without engaging the community and being transparent. What we did see is that when talking to affected users many were using sub2api. Converting a subscription into api traffic to then re-serve or share across many users is not something we support and this type of usage gets flagged by our fraud-prevention systems. You are completely fine if you use your subscription through Sign in With ChatGPT, either through the official clients or through one of the many OSS clients (Pi, OpenCode, ...) that support signing in with your account and using your included usage.

    推荐理由:官方一次性交代 Codex 的用户规模、额度补偿与限流调查口径,可据此了解其用量政策的边界。

  2. IT Home80

    OpenAI 开源 Codex Harness,放出 CLI、SDK 与 app-server 三类组件

    OpenAI 以 Apache-2.0 许可开源驱动 Codex 的底层执行框架 Harness,并放出三类组件:运行自动化流水线的 codex exec CLI、支持 TypeScript 和 Python 的 Codex SDK,以及通过 JSON-RPC 连接本地 Codex 进程的 app-server。

    推荐理由:开源的三类组件与 Harness 调优带来的基准变化,可供开发者评估把智能体嵌入自有产品的落地方式。

  3. OpenRouter Announcements62

    OpenRouter 上线 Visual Image Benchmarks 覆盖 39 个图像模型

    OpenRouter 发布 Visual Image Benchmarks,帮助用户评估其平台上的 39 个图像模型(截至 2026 年 8 月)。挑战提示词分七类:不太可能的场景、计数、文字、空间关系、否定、编辑和一致性,结果以网格展示并支持按价格和生成时间排序。视频和音频等更多模态的评估即将推出,用户也可通过 OpenRouter API 或 Chat 试用模型。

    推荐理由:原文给出七类挑战提示词和按价格与生成时间排序的结果网格,读者可直接用它对比 39 个图像模型的真实能力。

  4. @ClaudeDevs70

    Claude Platform 上的 computer use、browser tool、Skills API 和 Files API 现已正式可用(generally available)。官方表示,这些能力可用于在没有 API 的应用中自动化工作,并减少每个任务的往返次数;开发者也可以基于版本化的 skills 和可复用文件构建 Claude Managed Agents。https://t.co/aXHuc6eQBB

    原始视频预览图;未保存可播放视频URL

    推荐理由:这些能力从测试转为正式可用,开发者可在没有 API 的应用里做自动化,并用版本化技能和可复用文件搭建托管智能体。

  5. Claude Blog72

    Claude 平台 computer use、Skills API 和 Files API 正式可用

    Anthropic 宣布 computer use、Skills API 和 Files API 在 Claude Platform 正式可用,computer use 同时新增 browser use 工具,除截图外还读取页面结构,让智能体定位具体字段或按钮。

    推荐理由:正式版给出了多动作执行、浏览器工具和文件存储的具体变化,可据此判断现有智能体工作流的改造空间。

  6. xAI News70

    xAI 将 Grok Build 开放至网页、iOS 和 Android

    xAI 将 Grok Build 从 7 月起仅限 SuperGrok Heavy 的 Early Beta 开放给所有用户,网页、iOS 和 Android 均可使用,只需在对话中描述应用、游戏、网站或仪表盘即可生成可运行版本。

    推荐理由:Grok Build 从仅限 SuperGrok Heavy 的早期测试转向全量开放,并补齐发布分享、自有域名与 GitHub 导出等交付环节。

  7. Hugging Face Blog65

    Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理吞吐最高提升 3.2x

    Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 三个模型发布 DSpark 草稿模型 checkpoint,通过投机解码在不改变输出质量的前提下加速推理,GPU 吞吐最高提升 3.18x,端侧最高 2.87x。

    推荐理由:官方为 LFM2.5 三款模型发布 DSpark 草稿模型,给出从 H100 到 MacBook 的实测加速数据和开源接入方式。

8月20日周四
  1. Mistral AI66

    Mistral 发布 Agentic Search,多步检索在 FinanceBench 上将准确率从 26.7% 提升至 86%

    Mistral 发布 Agentic Search,通过 search、open、navigate、read、grep 五个工具让模型多步检索、翻阅并验证复杂文档,可通过 Mistral Search Toolkit 及 Studio 和 Vibe 中的 Libraries 使用,无需微调。

    推荐理由:官方给出多步检索循环的完整工具设计和两个基准的具体数字,读者可据此评估它替代一次性 RAG 的适用场景。