跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

当前仅显示精选新闻

最新精选

第 161–180 条 · 共 834 条
9月11日周五
  1. @AYi_AInotes67

    Cursor 发布 Projects 功能,把原本单次对话式的写代码流程改成常驻项目组的智能体协作形态。官方内部统计显示,主力使用 Projects 的工程师 PR 合入量达到原来的 6 倍。该功能包含不直接改代码、只负责拆解任务并派发子 Agent 的协调者,沉淀仓库测试方式与设计约束的全局上下文文件,以及可挂载 Slack、GitHub 订阅后自动响应报错和 CI 失败的常在线事件驱动机制。

    原始视频预览图;未保存可播放视频URL

    推荐理由:原文给出协调者调度子 Agent、全局上下文与事件驱动三项设计,可据此理解编码智能体从单次对话转向常驻项目协作的变化。

  2. @gdb70

    OpenAI 在 API 中开放 GPT-Live-1,开发者可把 ChatGPT 式的自然对话体验接入自己的应用。该语音智能体可在说话的同时持续聆听,并支持搭配开发者自选的模型与 harness。

    引用@OpenAIDevs@OpenAIDevs

    GPT-Live-1 is now available in the API. Bring ChatGPT’s natural back-and-forth to your app, with voice agents that listen while they speak and work with the models and harness you choose. https://t.co/gIl1gwsBDV

    推荐理由:GPT-Live-1 开放 API 后,开发者可把边听边说的语音智能体接入自家应用并自选模型与 harness。

  3. @jxnlco72

    OpenAI 开发者账号宣布推出 Agents API 公测版,开发者可借助 Codex harness 构建并运行云端智能体。该 API 由 OpenAI 全托管,负责编排、长时间运行的会话和上下文管理,开发者只需专注智能体本身的差异化部分。

    引用@OpenAIDevs@OpenAIDevs

    Go from idea to a working agent faster with the Agents API. Build and run cloud agents with the Codex harness, fully managed by OpenAI. We handle orchestration, long-running sessions, and context management. You focus on what makes your agent unique. Available in public beta. https://t.co/74siIaFdg4

    推荐理由:OpenAI 把 Codex harness 打包成托管的 Agents API,读者可据此判断自建智能体的编排与上下文成本。

  4. @OpenAIDevs70

    OpenAI Developers 介绍 Agents API 由 OpenAI 在自家基础设施上运行智能体循环,负责协调模型调用、工具使用与上下文。开发者可控制智能体的能力,并选择运行代码和处理文件的位置。示意图显示应用向 Agents API 发送任务并接收事件与输出,Agents API 作为托管 Codex harness 向沙箱下发工具调用,沙箱可运行在 OpenAI 或开发者自选的服务商上,应用还可控制自托管算力。

    推荐理由:原文给出 Agents API 托管智能体循环与自托管算力的分工,便于判断部署边界。

  5. @testingcatalog71

    OpenAI 已在 API 与 OpenAI Platform 上线 GPT-Live-1,把 ChatGPT 的全双工自然对话能力开放给开发者,并让语音智能体的说话与行为获得更多控制。开发者可以用双向语音模式构建应用和工作流,把任务转派给其他模型,也可自行选择搭配的模型与 harness。

    原始视频预览图;未保存可播放视频URL
    引用@OpenAIDevs@OpenAIDevs

    GPT-Live-1 is now available in the API. Bring ChatGPT’s natural back-and-forth to your app, with voice agents that listen while they speak and work with the models and harness you choose. https://t.co/gIl1gwsBDV

    推荐理由:全双工语音对话能力开放到 API,开发者可搭建可转派任务的语音智能体,语音应用的工作流编排随之变化。

  6. @Thom_Wolf69

    OpenAI 开发者账号宣布 GPT-Live-1 已在 API 中可用,开发者可在自有应用中接入能边听边说的语音智能体,并自行选择模型与框架。Hugging Face 联创 Thomas Wolf 转发了这条消息,并配上一张机器人图片。

    引用@OpenAIDevs@OpenAIDevs

    GPT-Live-1 is now available in the API. Bring ChatGPT’s natural back-and-forth to your app, with voice agents that listen while they speak and work with the models and harness you choose. https://t.co/gIl1gwsBDV

    推荐理由:OpenAI 将 GPT-Live-1 语音能力放进 API,开发者可据此判断语音智能体的接入方式。

  7. @OpenAIDevs71

    OpenAI Developers 宣布 GPT-Live-1 已在 API 中上线,可把 ChatGPT 的自然多轮对话体验带进应用。该模型面向语音智能体,特点是在说话的同时继续聆听,并支持用户选择所用的模型与 harness。官方同时给出接入链接 https://t.co/gIl1gwsBDV。

    原始视频预览图;未保存可播放视频URL

    推荐理由:语音智能体能在说话的同时继续聆听,并可自选模型与 harness,读者可据此判断接入方式。

9月10日周四
  1. Cursor Blog76

    Cursor 推出 Projects,用协调智能体管理大规模长期开发工作

    Cursor 推出 Projects,可承接一项功能、一次迁移或完整应用等大规模工作,在长达数月的工作中维持上下文,并向数千个子智能体委派任务。它由不写代码的协调智能体统一指挥,核心包括默认云端运行、跨机器同步的共享上下文,以及监听 Slack、按计划运行和跟进 PR 的订阅能力。

    推荐理由:官方说明给出协调机制、共享上下文和订阅三类核心功能,以及内部使用数据,读者可据此评估是否纳入自己的开发流程。

  2. @kimmonismus74

    DeepSeek 发布 V4.1-Flash,作者引用 DeepSeek 的测试称其在多项编码与智能体基准上追平或超过 GPT-5.6 Sol,而输出 token 价格低 94%。

    引用@kimmonismus@kimmonismus

    DeepSeek just released V4.1-Flash with a new architecture, six weeks after its July V4-Flash update. July’s release improved post-training while keeping the architecture unchanged. (Same with GLM-5.3/Flash) V4.1 introduces a Causal Encoder–Decoder architecture with native visual understanding. DeepSeek reports: - 552B MoE parameters, with 8B active during input processing and 16B during output generation. - KV-cache requirements cut to ¼ of the HBM and ⅛ of the SSD storage versus the previous generation. - Lower API prices. These are *significant* jumps in just a few weeks with post training. This is the new reality we have to adapt to: weekly releases with significant improvements. The company says Flash now beats V4-Pro on capability, cost and speed. Starting September 14, V4-Pro API requests will temporarily route to V4.1-Flash until V4.1-Pro arrives.

    推荐理由:文中给出 DeepSeek V4.1-Flash 的定价与 DeepSWE 基准对比,读者可据此判断价格战对智能体调用成本的影响。

  3. Z Potentials · 微信公众号67

    GPT-6 Astra与实时视频模型并进,AI游戏和互动内容成本结构重排

    文章梳理一周内互动内容的模型竞争:OpenAI发布GPT-6 Astra与GPT-image-2.5(延迟最多降50%),fal发布H3 Max/H3 Max Turbo,Yoroll发布基于MiniMax H3的H3 Superfast(8×B200上推理10秒视频约需4秒)及实时互动产品YoLive。

    推荐理由:原文梳理了实时视频生成与GPT-6带动AI游戏的具体玩法、成本结构和Harness搭建思路,给出了可参照的分析框架。