Claude Code v2.1.286 发布,集中修复了 MCP 错误信息泄露凭据值、Bearer 令牌部分脱敏、远程控制会话在策略关闭后仍保持连接等问题。同时改进权限提示、全屏列表鼠标操作和 VSCode 书签功能。
精选最新精选
2026年10月1日星期四 · AI 自动挑选的高价值内容
Google 正在 Gemini 聊天中用 Skills 取代 Gems。Skills 是详细、可复用的提示词,用户输入“/”即可调用,或由 Gemini 自动运行,其格式基于 Anthropic 的开放标准。Gems 将从 11 月起逐步淘汰,现有 Gems 会自动迁移。
Meta 和 OpenAI 计划在未来一年内推出专用 AI 硬件,路径都是先用可爱软件智能体测试市场。OpenAI 与 Jony Ive 合作的设备不早于 2027 年 2 月发货,Meta 的 Muse Charm 吊坠式设备目标在今年假日购物季前推出。此前 Friend 和 Humane AI Pin 等专用 AI 设备主要引发失望和反弹。
Databricks 发布新的 AI 函数 ai_decide,由决策模型驱动,可在几分之一秒内对文本评估一个或多个问题,并返回概率、命名标准中的选项或有序评分。它面向模型路由、文档处理、智能体评估等场景,相比 LLM 在类似任务上延迟和成本更低。目前以 Beta 形式提供,可通过 SQL 或 REST API 调用。
Databricks 与 OpenAI、Stellantis 讨论企业规模化智能体应用时提出,基础设施需提供选择、上下文和控制三项能力。Databricks 用 Agent Bricks、Omnigent 和 Unity Gateway 分别承担统一平台、跨框架组合和集中管控,避免每个智能体各自形成独立集成与治理项目。
Ideogram 4.5 已上线 Krea。该模型针对重复编辑场景设计,旨在解决多次编辑通常产生的伪影、像素偏移和色彩漂移问题。
Gemini 推出 Skills 功能,将针对特定任务的指令保存为可复用的快捷方式,用户无需反复输入相同提示词即可直接获得结果。原文仅给出这一功能描述,未提供可用范围、设置方式或效果数据。
DoorDash 周三宣布推出文本点餐 AI 智能体,用户可通过 Apple Messages 发送“点我常点的”等指令,智能体会理解其指周五晚上的订单,并支持指定菜品、本地推荐、发送食物照片,以及处理多人混合饮食偏好和不同数量。该功能在美国开放候补名单。
Perplexity 发布自研 Rust 检索与排序引擎 Photon,已接管全部生产流量。其 p99 检索与排序延迟从约 800 ms 降至约 65 ms,服务机器比旧内容节点少约 20%,每文档存储数据量约为旧引擎的 2.5 倍。Photon 本身不开源,只能通过托管 API 使用。
RSA 在旧金山 AI 大会上发布 Agent ID,面向金融、政府、医疗和关键基础设施等受监管行业,用于发现、授权和治理企业内的 AI 智能体。Jim Taylor 举例称,一名客服员工让智能体“去 Salesforce 获取所有数据”,结果智能体开始下载整个 Salesforce 数据库,触发防御系统并导致实例宕机。RSA 对一家自称没有智能体的中型银行审计后,发现超过 4000 个影子智能体在运行。
OpenRouter 发布了一篇指南,介绍测试 AI 智能体工具调用准确率的三种方法:无参考 LLM 评判、确定性参数校验和轨迹比较。指南还提供了 Python 测试框架,可通过 OpenRouter 对多个支持工具的模型运行相同测试用例。
Liquid AI 发布 d1,一个面向结构化选择的决策模型,不生成文本。用户提供上下文和一组带类型的问题,模型在单次调用中返回固定结果集上的校准概率,usage.output_tokens 始终为 0。目标场景包括分类、工单路由、评分、审核、重排序和 LLM-as-judge 检查。目前以托管 API 形式提供,模型名为 d1:free,无自托管权重。
OpenAI 在 Dev Day 上宣布多项功能,把 ChatGPT 变成软件可被发现、启动和使用的入口,并推出 Sign in with ChatGPT 让用户把 AI 额度带入第三方应用。ChatGPT 会在对话中识别任务并推荐应用,插件架构扩展支持交互式面板,企业应用市场首发有 30 多家合作伙伴。OpenAI 未宣布与传统应用商店经济层相当的分账或计费系统。
Claude Code v2.1.285 发布,新增 CLAUDE_CODE_DISABLE_WEB_FETCH 环境变量以关闭 WebFetch 工具、claude --desktop 打开桌面应用、claude plugin configure 配置插件,以及 allowedProviders 托管设置限制可用 API 提供商。该版本同时修复了云会话、MCP 服务器、Artifact 工具、VSCode 扩展等大量问题。
OpenAI 帮助中心出现名为「ChatGPT Pro 500」的页面,在 Hacker News 上获得 114 分。原文未提供该页面具体内容、定价或功能说明。
OpenAI 在 2026 开发者日推出 Decisions API,面向实时低延迟分类与路由场景,约 150 毫秒返回结果,比通过常规 API 使用 Luna 快约 10 倍。该 API 基于小型模型 Luna,将智能聚焦到用户预定义的问题和有限答案集合上,返回选中答案及置信度等结构化信息。
OpenAI 推出 Decisions API,由 GPT-6 Luna 驱动,可让应用通过定义问题和可能答案来分类内容、路由请求或选择智能体的下一步动作。目前该 API 仅提供有限预览。
OpenAI 推出 dots,把 ChatGPT 从请求-响应循环变成常驻任务:用户设定目标、名称和边界后,dot 全天候执行并从反馈中学习。底层模型 GPT-6 Astra 在 OSWorld 2.0 上得分 72.6%,每任务约 40 分钟;GPT-5.6 Sol 为 65.7%、约 75 分钟。首个 dot 包含在 Pro 和 Business Premium 计划中,不额外收费。
关联讨论 2 条 来源:Hacker News popular via buzzing.cc (@alvis)来源:OpenAI official updatesOpenAI 推出 Dots,一种常驻 ChatGPT 智能体,每个 Dot 运行在 GPT-6 Astra 上,拥有自己的浏览器和云电脑,可接入超过 4K 个应用,并接受来自 ChatGPT、Slack 或 Teams 的指令。用户离开时,Dot 会以只读方式执行“主动研究”,扫描已连接应用;涉及变更的操作遵循内置审批默认值,并可由 Custom Rules 调整。OpenAI 同时提醒 Dots“仍可能犯错”。
OpenAI 宣布开放其平台,开发者现在可以构建带插件扩展的完整原生应用,并直接在 ChatGPT 内发布。官方称每周用户数超过 12 亿,并会在对话中展示相关插件。
OpenAI 在 2026 年开发者日推出 Ultrafast 服务层级,Codex 中最高 8 倍词元生成速度,API 调用最高 6 倍。GPT-6 Astra Ultrafast 在 Codex 中每秒可生成 300 个词元,已开放 API,Pro 500 订阅和企业用户可在 ChatGPT Work 与 Codex 中体验。官方称后续将推出 GPT-6.1 Sol Ultrafast。
dots 是一个常驻智能体,由 GPT-6 Astra 驱动,拥有自己的云电脑,并能访问用户的插件和上下文。开发者可将重复性 bug 报告与功能请求分类、围绕优先级梳理失败构建与功能改进、用 Codex 构建和测试变更并返回完整 PR 等工作交给它。用户可打开 dots 的云电脑检查工作,或接入自己的电脑以处理本地文件和代码。
Codex Security Cloud 迎来重大升级,默认包含通过 Daybreak Blue 访问网络能力模型。它可扫描整个 GitHub 仓库、持续审查新提交、调查并去重发现项,并准备修复方案供审查,即使笔记本关闭也能运行。该功能以插件形式在 Codex 桌面端和网页端提供。
OpenAI 在 DevDay 2026 发布智能助理 dots,采用四个卡通形象,可规划议程、设计网站、测试应用、修改笔记,并随时间了解用户工作习惯。dots 可与 ChatGPT 平台上 4,000 多款应用协同,由 GPT-6 Astra 模型提供支持,内置多重保护与安全机制。即日起向符合条件的 Pro 和 Business Premium 用户逐步开放,首个 dot 已包含在套餐中。
OpenAI 推出名为 Ultrafast 的高级速度档。Codex 中 token 生成最高提速 8 倍(300 tokens/秒),API 最高提速 6 倍。GPT-6 Astra Ultrafast 今日在 API、ChatGPT Work 和 Codex 的 Pro 500 及 Enterprise 套餐上线,GPT-6.1 Sol Ultrafast 即将推出。
OpenAI 在 Dev Day 发布 Dots,一款由 GPT-6 Astra 驱动的个人智能体助手。Dots 不依赖特定硬件或界面,可在后台持续执行用户设定的目标,仅需少量监督。周二起在 ChatGPT 中向符合条件的 Pro 和 Business Premium 用户开放,可通过 Slack、Teams 等平台联系,短信支持即将推出。
OpenAI 宣布在 ChatGPT 中推出 Space,提供一组新的协作体验。用户可与他人及自己的 dots 一起编辑富文本笔记,并带有实时可视化,适用于待办清单、产品计划或会议记录等场景。官方称与代理的协作是无缝的,内容会在后台自动保持更新;对开发者而言,这是 AGENTS.md 的进一步延伸。
OpenAI 在 DevDay 上发布 Dots,定位为常驻 AI 助手,由 GPT-6 Astra 驱动,可通过自有云电脑访问浏览器和 4000 多个应用,在后台跨应用执行任务并随时间学习用户偏好。用户可通过类似短信的界面或语音通话与 Dot 交互,也能接入 Microsoft Teams 和 Slack。目前每位用户只能创建一个 Dot,首发面向 ChatGPT Pro 和 Business Premium 用户。
OpenAI 在 Dev Day 上为软件工程智能体 Codex 推出可复用的云端开发环境,开发者可在电脑、手机或云端运行 Codex,任务启动更快,团队也能共享带预设权限的工作区。同时更新的还有支持语音控制的 Codex CLI、新的代码审查体验,以及用于扫描 GitHub 仓库并准备修复方案的安全工具 Codex Security Cloud。
在 DevDay 2026 上,OpenAI 为 Codex 增加了可复用云环境、GitHub 仓库自动安全扫描和桌面应用代码审查视图。Agents API 开始支持 Computer Use,新的 Decisions API 用于处理快速单次决策。Ultrafast 高级档承诺最高 8 倍速度,价格为 6 倍。
OpenAI 宣布在 ChatGPT 中推出 Dots 个性化 AI 助手,由 Astra 驱动,可处理长任务、支持语音对话,并在云端拥有独立 VM。用户今天起可获得一个 Dot,后续将通过消息应用开放,支持 4k+ 连接器,且很可能仅限 Pro 200 套餐使用。
Meta 上线 Muse for Small Business,一次提供 22 个官方连接器,覆盖 Shopify、Stripe、QuickBooks、Canva、Zoom、Slack 等,把查账退款、内容营销、客户日程收拢到一个对话框里。上线两周的早期用户中,有 1/3 把 Muse 绑定了商业账号。涉及扣费、退款、对外公开发布的操作仍需人工最后确认。
CData 发布面向智能体的 AI 网关,负责把每个请求路由到合适模型、在每次调用中执行身份与策略控制,并把经人工批准的更正存储为上下文。其上下文图谱独立于任何模型,可导入 dbt 和 Power BI 的定义,使“revenue”这类业务语义在更换模型后仍能延续。
英伟达推出 Open Agent Safety Platform,黄仁勋称其本质是“代理的浏览器”,只允许代理访问完成工作所需的内容。平台包含运行在 CPU 上的 OpenShell 和运行在网络芯片上的 Sentry,分别负责限制能力与监控代理。英伟达称该平台本可阻止 7 月 OpenAI 模型逃逸并攻击 Hugging Face 的事件。
OpenRouter 对比了 Veo 3.1、Seedance、Kling 和 Grok Imagine Video 四条图生视频产品线在时长、分辨率、首尾帧控制、生成音频、参考输入和每秒价格上的差异,并给出用 TypeScript SDK 提交图生视频任务的示例。
Cloudflare 推出新命令行工具 cf,面向智能体使用场景,将可操作范围从 Wrangler 约 280 个命令扩展到 Cloudflare API 全部 3000 多个操作。cf 默认输出 JSON,采用 TypeScript 配置格式 cloudflare.config.ts,并以 Vite 作为默认构建工具。
快手可灵 AI 宣布 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 已于 9 月 28 日向黑金年卡会员开放抢先体验。Kling 4.0 支持 4K、1080p 的 10-bit HDR 输出,单次生成视频最长 30 秒,并支持最多 10 张图片、5 段视频及 7 个主体在同一任务中组合使用。
Lakebase 在 AWS 和 Azure 上正式发布两个 Postgres 搜索扩展:lakebase_vector 做可扩展近似近邻搜索,lakebase_text 做 BM25 全文搜索。在 VectorDBBench 100M 基准中,其吞吐是次优系统的两倍,成本比使用 pgvector 的云 Postgres 供应商低 4 倍;测试中 P99 延迟 71 毫秒、召回率 97%。
英伟达 CEO 黄仁勋周一推出 Open Agent Safety Platform,将开源软件 OpenShell 与运行在 BlueField-4 DPU 上的独立监控系统 Sentry 结合,在智能体试图越界时于毫秒级将其隔离。该平台旨在为 AI 智能体增加独立安全层,确保其留在测试环境内。
Claude Code v2.1.284 将 Claude Sonnet 5.5(claude-sonnet-5-5)设为 Anthropic API 上的默认 Sonnet 模型,提供 1M 上下文,定价为每 Mtok 输入 2 美元、输出 10 美元,缓存读取 0.20 美元/Mtok。该版本还包含大量针对终端、VS Code、Claude Tag 和网关的修复与改进。