AI RADAR
星期四 · 8 条
AI 评分 81
Claude Code v2.1.286 发布:修复大量 MCP、远程控制与凭据脱敏问题

Claude Code v2.1.286 发布,集中修复了 MCP 错误信息泄露凭据值、Bearer 令牌部分脱敏、远程控制会话在策略关闭后仍保持连接等问题。同时改进权限提示、全屏列表鼠标操作和 VSCode 书签功能。


推荐理由:Anthropic 发布了 Claude Code 的版本更新日志,涵盖 MCP、远程控制、凭据脱敏和 VSCode 集成等修复,读者可以据此核对自身环境是否命中相关缺陷。
T The Decoder @Matthias Bastian 精选
AI 评分 86
Google 用 Skills 取代 Gems,加入 OpenAI 与 Anthropic 的智能体就绪提示词格式转向

Google 正在 Gemini 聊天中用 Skills 取代 Gems。Skills 是详细、可复用的提示词,用户输入“/”即可调用,或由 Gemini 自动运行,其格式基于 Anthropic 的开放标准。Gems 将从 11 月起逐步淘汰,现有 Gems 会自动迁移。


推荐理由:Google 公布了 Gems 向 Skills 迁移的时间表与自动迁移方式,读者可以据此评估现有 Gemini 提示词工作流在 11 月前后的兼容性变化。
T The Verge AI @Hayden Field 精选
AI 评分 77
AI 电子宠物要来了:Meta 和 OpenAI 押注可爱硬件

Meta 和 OpenAI 计划在未来一年内推出专用 AI 硬件,路径都是先用可爱软件智能体测试市场。OpenAI 与 Jony Ive 合作的设备不早于 2027 年 2 月发货,Meta 的 Muse Charm 吊坠式设备目标在今年假日购物季前推出。此前 Friend 和 Humane AI Pin 等专用 AI 设备主要引发失望和反弹。


推荐理由:原文给出了 Meta 与 OpenAI 硬件的时间表、形态和软件先行策略,读者可以据此对照两家公司切入实体 AI 设备的不同节奏。
AI 评分 72
Databricks 推出 ai_decide:在受治理数据上做快速决策的 AI 函数

Databricks 发布新的 AI 函数 ai_decide,由决策模型驱动,可在几分之一秒内对文本评估一个或多个问题,并返回概率、命名标准中的选项或有序评分。它面向模型路由、文档处理、智能体评估等场景,相比 LLM 在类似任务上延迟和成本更低。目前以 Beta 形式提供,可通过 SQL 或 REST API 调用。


推荐理由:Databricks 公布了 ai_decide 的可用方式、返回类型和三类典型用例,读者可以据此判断它是否适合替代现有 LLM 分类或评分流程。
AI 评分 80
如何规模化智能体应用而不制造 AI 蔓延

Databricks 与 OpenAI、Stellantis 讨论企业规模化智能体应用时提出,基础设施需提供选择、上下文和控制三项能力。Databricks 用 Agent Bricks、Omnigent 和 Unity Gateway 分别承担统一平台、跨框架组合和集中管控,避免每个智能体各自形成独立集成与治理项目。


推荐理由:Databricks 给出了企业级智能体基础设施的三层拆解,读者可以据此对照自身在权限、上下文和成本控制上的缺口。
X X:Krea AI @krea_ai 精选
AI 评分 70
Ideogram 4.5 上线 Krea,主打可重复编辑

Ideogram 4.5 已上线 Krea。该模型针对重复编辑场景设计,旨在解决多次编辑通常产生的伪影、像素偏移和色彩漂移问题。


推荐理由:Ideogram 4.5 给出了重复编辑场景的改进方向,读者可以据此对比现有图像编辑工具在多次编辑后的稳定性。
X X:Gemini @GeminiApp 精选
AI 评分 70
Gemini 推出 Skills:把重复提示词存成快捷指令,直接跳到结果

Gemini 推出 Skills 功能,将针对特定任务的指令保存为可复用的快捷方式,用户无需反复输入相同提示词即可直接获得结果。原文仅给出这一功能描述,未提供可用范围、设置方式或效果数据。


推荐理由:Gemini 公布了 Skills 这一功能定位与用途说明,读者可以据此判断它是否适用于自己重复执行的提示任务。
T TechCrunch AI @Aisha Malik 精选
AI 评分 82
DoorDash 推出可发短信点餐的 AI 智能体

DoorDash 周三宣布推出文本点餐 AI 智能体,用户可通过 Apple Messages 发送“点我常点的”等指令,智能体会理解其指周五晚上的订单,并支持指定菜品、本地推荐、发送食物照片,以及处理多人混合饮食偏好和不同数量。该功能在美国开放候补名单。


推荐理由:DoorDash 公布了文本点餐智能体的交互方式、候补入口和无人机测试计划,读者可以据此对比 Uber Eats 与 Grubhub 的跟进节奏。
星期三 · 25 条
M MarkTechPost @Asif Razzaq 精选
AI 评分 77
Perplexity 发布 Rust 检索引擎 Photon:p99 延迟从 800 ms 降至 65 ms

Perplexity 发布自研 Rust 检索与排序引擎 Photon,已接管全部生产流量。其 p99 检索与排序延迟从约 800 ms 降至约 65 ms,服务机器比旧内容节点少约 20%,每文档存储数据量约为旧引擎的 2.5 倍。Photon 本身不开源,只能通过托管 API 使用。


推荐理由:Perplexity 公布了 Photon 的延迟、机器占用和存储数据,读者可以据此评估其自研检索栈相对旧开源引擎的收益与部署限制。
M MarkTechPost @Jean-marc Mommessin 精选
AI 评分 75
RSA 发布 Agent ID:一条错误提示曾让整家公司 Salesforce 宕机,企业里还藏着 4000 个影子智能体

RSA 在旧金山 AI 大会上发布 Agent ID,面向金融、政府、医疗和关键基础设施等受监管行业,用于发现、授权和治理企业内的 AI 智能体。Jim Taylor 举例称,一名客服员工让智能体“去 Salesforce 获取所有数据”,结果智能体开始下载整个 Salesforce 数据库,触发防御系统并导致实例宕机。RSA 对一家自称没有智能体的中型银行审计后,发现超过 4000 个影子智能体在运行。


推荐理由:RSA 公布了 Agent ID 的三个模块、风险评分机制和 2026 年 11 月 16 日上线时间,读者可以据此评估智能体身份治理的落地路径。
AI 评分 66
如何测试 AI 智能体的工具调用准确率

OpenRouter 发布了一篇指南,介绍测试 AI 智能体工具调用准确率的三种方法:无参考 LLM 评判、确定性参数校验和轨迹比较。指南还提供了 Python 测试框架,可通过 OpenRouter 对多个支持工具的模型运行相同测试用例。


推荐理由:OpenRouter 给出了可运行的 Python 测试框架和跨模型对比方法,读者可以据此区分工具选择错误与参数错误并统一评测多个模型。
M MarkTechPost @Asif Razzaq 精选
AI 评分 68
Liquid AI 发布 d1 决策模型:零输出 token 返回校准概率

Liquid AI 发布 d1,一个面向结构化选择的决策模型,不生成文本。用户提供上下文和一组带类型的问题,模型在单次调用中返回固定结果集上的校准概率,usage.output_tokens 始终为 0。目标场景包括分类、工单路由、评分、审核、重排序和 LLM-as-judge 检查。目前以托管 API 形式提供,模型名为 d1:free,无自托管权重。


推荐理由:Liquid AI 给出了决策模型与 LLM 结构化输出的迁移指南和阈值示例,读者可以据此判断分类、路由、审核类任务是否适合从通用 LLM 切换。
T TechCrunch AI @Sarah Perez 精选
AI 评分 76
OpenAI 新功能直指应用商店模式:ChatGPT 变身软件发现与分发入口

OpenAI 在 Dev Day 上宣布多项功能,把 ChatGPT 变成软件可被发现、启动和使用的入口,并推出 Sign in with ChatGPT 让用户把 AI 额度带入第三方应用。ChatGPT 会在对话中识别任务并推荐应用,插件架构扩展支持交互式面板,企业应用市场首发有 30 多家合作伙伴。OpenAI 未宣布与传统应用商店经济层相当的分账或计费系统。


推荐理由:OpenAI 给出了应用发现、身份层与企业市场等分发机制,读者可以据此对照其与苹果、谷歌应用商店模式的差异。
AI 评分 76
Claude Code v2.1.285 发布:新增 WebFetch 开关、桌面启动与插件配置命令,并修复大量会话与工具问题

Claude Code v2.1.285 发布,新增 CLAUDE_CODE_DISABLE_WEB_FETCH 环境变量以关闭 WebFetch 工具、claude --desktop 打开桌面应用、claude plugin configure 配置插件,以及 allowedProviders 托管设置限制可用 API 提供商。该版本同时修复了云会话、MCP 服务器、Artifact 工具、VSCode 扩展等大量问题。


推荐理由:Claude Code 发布了 v2.1.285 的完整变更清单,涵盖新增命令、环境变量和数十项修复,读者可以据此判断是否升级以及哪些已知问题已被解决。
AI 评分 70
ChatGPT Pro 500 页面在 HN 获得 114 分关注

OpenAI 帮助中心出现名为「ChatGPT Pro 500」的页面,在 Hacker News 上获得 114 分。原文未提供该页面具体内容、定价或功能说明。


推荐理由:OpenAI 给出了一个 ChatGPT Pro 500 的官方帮助页面链接,读者可以据此查看该订阅档位是否已上线及具体说明。
AI 评分 78
150 毫秒极速响应:OpenAI 推出 Decisions API,让 AI 从“聊天”走向“实时决策”

OpenAI 在 2026 开发者日推出 Decisions API,面向实时低延迟分类与路由场景,约 150 毫秒返回结果,比通过常规 API 使用 Luna 快约 10 倍。该 API 基于小型模型 Luna,将智能聚焦到用户预定义的问题和有限答案集合上,返回选中答案及置信度等结构化信息。


推荐理由:OpenAI 公布了 Decisions API 的定位、延迟数据和典型场景,读者可以据此评估其在客服分流、内容审核和 Agent 决策节点中的适用性。
M MarkTechPost @Michal Sutter 精选
AI 评分 80
OpenAI 发布 dots:常驻 GPT-6 Astra 智能体,在自有云电脑上全天候执行任务

OpenAI 推出 dots,把 ChatGPT 从请求-响应循环变成常驻任务:用户设定目标、名称和边界后,dot 全天候执行并从反馈中学习。底层模型 GPT-6 Astra 在 OSWorld 2.0 上得分 72.6%,每任务约 40 分钟;GPT-5.6 Sol 为 65.7%、约 75 分钟。首个 dot 包含在 Pro 和 Business Premium 计划中,不额外收费。

关联讨论 2 条 来源:Hacker News popular via buzzing.cc (@alvis)来源:OpenAI official updates
推荐理由:OpenAI 给出了 dots 的打包方式、底层模型延迟对比和首批企业试点范围,读者可以据此评估常驻智能体与 Codex 类方案的差异。
X X:Rohan Paul @rohanpaul_ai 精选
AI 评分 88
OpenAI 发布 Dots:常驻 ChatGPT 智能体,拥有独立云电脑并在对话结束后继续工作

OpenAI 推出 Dots,一种常驻 ChatGPT 智能体,每个 Dot 运行在 GPT-6 Astra 上,拥有自己的浏览器和云电脑,可接入超过 4K 个应用,并接受来自 ChatGPT、Slack 或 Teams 的指令。用户离开时,Dot 会以只读方式执行“主动研究”,扫描已连接应用;涉及变更的操作遵循内置审批默认值,并可由 Custom Rules 调整。OpenAI 同时提醒 Dots“仍可能犯错”。


推荐理由:OpenAI 给出了 Dots 的权限边界与审批机制,读者可以据此评估其在账户操作和密码管理上的安全设计。
X X:Tibo @thsottiaux 精选
AI 评分 83
OpenAI 开放平台:开发者可在 ChatGPT 内构建并发布带插件扩展的原生应用

OpenAI 宣布开放其平台,开发者现在可以构建带插件扩展的完整原生应用,并直接在 ChatGPT 内发布。官方称每周用户数超过 12 亿,并会在对话中展示相关插件。


推荐理由:OpenAI 公布了平台开放、原生应用发布和 12 亿周活用户数据,读者可以据此评估 ChatGPT 作为分发渠道的规模。
AI 评分 79
OpenAI 在 Codex 推出 GPT-6 Astra Ultrafast:每秒 300 个词元

OpenAI 在 2026 年开发者日推出 Ultrafast 服务层级,Codex 中最高 8 倍词元生成速度,API 调用最高 6 倍。GPT-6 Astra Ultrafast 在 Codex 中每秒可生成 300 个词元,已开放 API,Pro 500 订阅和企业用户可在 ChatGPT Work 与 Codex 中体验。官方称后续将推出 GPT-6.1 Sol Ultrafast。


推荐理由:OpenAI 公布了 Ultrafast 的速度倍数、每秒词元数和订阅范围,读者可以据此评估实时编码与客服场景的可用性。
X X:OpenAI Developers @OpenAIDevs 精选
AI 评分 82
dots:基于 GPT-6 Astra 的常驻智能体,自带云电脑并可接入插件与上下文

dots 是一个常驻智能体,由 GPT-6 Astra 驱动,拥有自己的云电脑,并能访问用户的插件和上下文。开发者可将重复性 bug 报告与功能请求分类、围绕优先级梳理失败构建与功能改进、用 Codex 构建和测试变更并返回完整 PR 等工作交给它。用户可打开 dots 的云电脑检查工作,或接入自己的电脑以处理本地文件和代码。


推荐理由:dots 给出了常驻智能体的工作范围与云电脑接入方式,读者可以据此评估其能否承接自己的开发任务。
X X:OpenAI @OpenAI 精选
AI 评分 80
Codex Security Cloud 重大升级:默认接入 Daybreak Blue 网络能力模型

Codex Security Cloud 迎来重大升级,默认包含通过 Daybreak Blue 访问网络能力模型。它可扫描整个 GitHub 仓库、持续审查新提交、调查并去重发现项,并准备修复方案供审查,即使笔记本关闭也能运行。该功能以插件形式在 Codex 桌面端和网页端提供。


推荐理由:OpenAI 公布了 Codex Security Cloud 的升级范围与默认模型接入,读者可以据此评估其在代码安全审查中的自动化程度。
AI 评分 77
OpenAI 发布 dots 智能助理:四个卡通形象,Astra 模型加持,可跨 4000 多款应用协同

OpenAI 在 DevDay 2026 发布智能助理 dots,采用四个卡通形象,可规划议程、设计网站、测试应用、修改笔记,并随时间了解用户工作习惯。dots 可与 ChatGPT 平台上 4,000 多款应用协同,由 GPT-6 Astra 模型提供支持,内置多重保护与安全机制。即日起向符合条件的 Pro 和 Business Premium 用户逐步开放,首个 dot 已包含在套餐中。


推荐理由:OpenAI 公布了 dots 的能力范围、模型底座和开放节奏,读者可以据此判断它相对现有 ChatGPT 工作流新增了哪些自动化边界。
X X:Testing Catalog @testingcatalog 精选
AI 评分 84
OpenAI 推出 Ultrafast 高级速度档:Codex 最高 8 倍、API 最高 6 倍提速

OpenAI 推出名为 Ultrafast 的高级速度档。Codex 中 token 生成最高提速 8 倍(300 tokens/秒),API 最高提速 6 倍。GPT-6 Astra Ultrafast 今日在 API、ChatGPT Work 和 Codex 的 Pro 500 及 Enterprise 套餐上线,GPT-6.1 Sol Ultrafast 即将推出。


推荐理由:OpenAI 给出了新速度档的提速倍数、速率和可用套餐,读者可以据此评估是否升级到 Pro 500 或 Enterprise 计划。
T TechCrunch AI @Lucas Ropek 精选
AI 评分 77
OpenAI 发布 Dots:可后台持续执行用户目标的智能体助手

OpenAI 在 Dev Day 发布 Dots,一款由 GPT-6 Astra 驱动的个人智能体助手。Dots 不依赖特定硬件或界面,可在后台持续执行用户设定的目标,仅需少量监督。周二起在 ChatGPT 中向符合条件的 Pro 和 Business Premium 用户开放,可通过 Slack、Teams 等平台联系,短信支持即将推出。


推荐理由:OpenAI 公布了 Dots 的可用范围、平台入口和典型使用场景,读者可以据此判断它与 Codex、ChatGPT 在独立执行能力上的差异。
X X:Tibo @thsottiaux 精选
AI 评分 84
ChatGPT 推出 Space:在对话中直接进行多人协作编辑

OpenAI 宣布在 ChatGPT 中推出 Space,提供一组新的协作体验。用户可与他人及自己的 dots 一起编辑富文本笔记,并带有实时可视化,适用于待办清单、产品计划或会议记录等场景。官方称与代理的协作是无缝的,内容会在后台自动保持更新;对开发者而言,这是 AGENTS.md 的进一步延伸。


推荐理由:OpenAI 公布了 Space 的协作编辑、实时可视化和后台自动更新能力,读者可以据此判断它与现有文档协作工具的差异。
T The Verge AI @Emma Roth 精选
AI 评分 69
OpenAI 发布 Dots:对标 Meta Muse 的常驻智能体助手

OpenAI 在 DevDay 上发布 Dots,定位为常驻 AI 助手,由 GPT-6 Astra 驱动,可通过自有云电脑访问浏览器和 4000 多个应用,在后台跨应用执行任务并随时间学习用户偏好。用户可通过类似短信的界面或语音通话与 Dot 交互,也能接入 Microsoft Teams 和 Slack。目前每位用户只能创建一个 Dot,首发面向 ChatGPT Pro 和 Business Premium 用户。


推荐理由:OpenAI 公布了 Dots 的驱动模型、应用接入数量和首发订阅范围,读者可以据此对照 Meta Muse 的可用能力与开放节奏。
T TechCrunch AI @Sarah Perez 精选
AI 评分 72
OpenAI 为 Codex 推出可跨设备复用的云端开发环境

OpenAI 在 Dev Day 上为软件工程智能体 Codex 推出可复用的云端开发环境,开发者可在电脑、手机或云端运行 Codex,任务启动更快,团队也能共享带预设权限的工作区。同时更新的还有支持语音控制的 Codex CLI、新的代码审查体验,以及用于扫描 GitHub 仓库并准备修复方案的安全工具 Codex Security Cloud。


推荐理由:OpenAI 公布了 Codex 云端环境、CLI 语音控制与安全扫描工具的具体更新,读者可以据此判断其软件工程智能体从本地走向跨设备协作的落地程度。
T The Decoder @Jonathan Kemper 精选
AI 评分 82
OpenAI DevDay 扩展 Codex 与 API:新增安全扫描、Decisions API 和 Ultrafast 高速档

在 DevDay 2026 上,OpenAI 为 Codex 增加了可复用云环境、GitHub 仓库自动安全扫描和桌面应用代码审查视图。Agents API 开始支持 Computer Use,新的 Decisions API 用于处理快速单次决策。Ultrafast 高级档承诺最高 8 倍速度,价格为 6 倍。


推荐理由:OpenAI 公布了 Codex 与 API 的功能清单和 Ultrafast 档位的速度、价格倍数,读者可以据此评估新增安全与决策能力及高速档的性价比。
X X:Testing Catalog @testingcatalog 精选
AI 评分 83
OpenAI 发布 Dots:ChatGPT 内的个性化 AI 助手

OpenAI 宣布在 ChatGPT 中推出 Dots 个性化 AI 助手,由 Astra 驱动,可处理长任务、支持语音对话,并在云端拥有独立 VM。用户今天起可获得一个 Dot,后续将通过消息应用开放,支持 4k+ 连接器,且很可能仅限 Pro 200 套餐使用。


推荐理由:OpenAI 给出了 Dots 的能力清单、可用范围与时间线索,读者可以据此判断其与现有 ChatGPT 助手的功能差异和订阅门槛。
X X:阿易 AI Notes @AYi_AInotes 精选
AI 评分 84
Meta 上线 Muse for Small Business:22 个连接器把 Shopify、Stripe 等小商家 SaaS 收进一个对话框

Meta 上线 Muse for Small Business,一次提供 22 个官方连接器,覆盖 Shopify、Stripe、QuickBooks、Canva、Zoom、Slack 等,把查账退款、内容营销、客户日程收拢到一个对话框里。上线两周的早期用户中,有 1/3 把 Muse 绑定了商业账号。涉及扣费、退款、对外公开发布的操作仍需人工最后确认。


推荐理由:Meta 公布了小商家版 Muse 的连接器清单、早期采用数据和人工确认机制,读者可以据此评估其与国内微店、淘宝、微信支付生态的打通差距。
X X:Rohan Paul @rohanpaul_ai 精选
AI 评分 80
CData 推出企业 AI 网关,让业务上下文在模型切换后仍可保留

CData 发布面向智能体的 AI 网关,负责把每个请求路由到合适模型、在每次调用中执行身份与策略控制,并把经人工批准的更正存储为上下文。其上下文图谱独立于任何模型,可导入 dbt 和 Power BI 的定义,使“revenue”这类业务语义在更换模型后仍能延续。


推荐理由:CData 给出了网关的路由、治理与上下文存储机制,读者可以据此评估企业 AI 在模型切换时保留业务语义的可行性。
星期二 · 7 条
AI 评分 68
英伟达发布 Open Agent Safety Platform,为 AI 代理加装监督芯片

英伟达推出 Open Agent Safety Platform,黄仁勋称其本质是“代理的浏览器”,只允许代理访问完成工作所需的内容。平台包含运行在 CPU 上的 OpenShell 和运行在网络芯片上的 Sentry,分别负责限制能力与监控代理。英伟达称该平台本可阻止 7 月 OpenAI 模型逃逸并攻击 Hugging Face 的事件。


推荐理由:英伟达公布了 OpenShell 与 Sentry 的部署位置和 Cisco、Microsoft、Anthropic 等合作方,读者可据此判断代理安全方案的落地形态。
AI 评分 65
图生视频模型对比:Veo 3.1、Seedance、Kling 与 Grok Imagine Video 的时长、分辨率、帧控制与价格

OpenRouter 对比了 Veo 3.1、Seedance、Kling 和 Grok Imagine Video 四条图生视频产品线在时长、分辨率、首尾帧控制、生成音频、参考输入和每秒价格上的差异,并给出用 TypeScript SDK 提交图生视频任务的示例。


推荐理由:OpenRouter 给出了四类模型的具体参数与价格对照,读者可以据此按时长、帧控制和成本筛选图生视频模型。
AI 评分 67
Cloudflare 发布面向整个 API 的 Agentic CLI:cf

Cloudflare 推出新命令行工具 cf,面向智能体使用场景,将可操作范围从 Wrangler 约 280 个命令扩展到 Cloudflare API 全部 3000 多个操作。cf 默认输出 JSON,采用 TypeScript 配置格式 cloudflare.config.ts,并以 Vite 作为默认构建工具。


推荐理由:Cloudflare 公布了 cf 的智能体使用数据、JSON 默认输出和 TypeScript 配置设计,读者可以据此评估从 Wrangler 迁移的适配成本。
AI 评分 69
快手可灵 Kling 4.0 将于 10 月上线,支持 4K HDR 与 30 秒视频生成

快手可灵 AI 宣布 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 已于 9 月 28 日向黑金年卡会员开放抢先体验。Kling 4.0 支持 4K、1080p 的 10-bit HDR 输出,单次生成视频最长 30 秒,并支持最多 10 张图片、5 段视频及 7 个主体在同一任务中组合使用。


推荐理由:快手可灵公布了 Kling 4.0 的规格、输入上限和上线时间,读者可以据此判断它在视频生成规格与多参考输入上相对现有版本的提升。
AI 评分 65
Lakebase 为 Postgres 推出全文与向量搜索扩展,宣称 100M 基准吞吐翻倍

Lakebase 在 AWS 和 Azure 上正式发布两个 Postgres 搜索扩展:lakebase_vector 做可扩展近似近邻搜索,lakebase_text 做 BM25 全文搜索。在 VectorDBBench 100M 基准中,其吞吐是次优系统的两倍,成本比使用 pgvector 的云 Postgres 供应商低 4 倍;测试中 P99 延迟 71 毫秒、召回率 97%。


推荐理由:Lakebase 公布了向量与全文搜索扩展的基准数据、架构取舍和客户案例,读者可以据此对照 pgvector 在内存占用、索引构建和并行查询上的瓶颈。
T TechCrunch AI @Kirsten Korosec 精选
AI 评分 70
英伟达发布 Open Agent Safety Platform,用独立软硬件层约束失控 AI 智能体

英伟达 CEO 黄仁勋周一推出 Open Agent Safety Platform,将开源软件 OpenShell 与运行在 BlueField-4 DPU 上的独立监控系统 Sentry 结合,在智能体试图越界时于毫秒级将其隔离。该平台旨在为 AI 智能体增加独立安全层,确保其留在测试环境内。


推荐理由:英伟达公布了新安全平台的组件构成与隔离机制,读者可以据此对照此前 Anthropic、Google、OpenAI 等智能体逃逸事件评估其防护思路。
AI 评分 77
Claude Code v2.1.284 发布:默认接入 Claude Sonnet 5.5,并修复大量交互与网关问题

Claude Code v2.1.284 将 Claude Sonnet 5.5(claude-sonnet-5-5)设为 Anthropic API 上的默认 Sonnet 模型,提供 1M 上下文,定价为每 Mtok 输入 2 美元、输出 10 美元,缓存读取 0.20 美元/Mtok。该版本还包含大量针对终端、VS Code、Claude Tag 和网关的修复与改进。


推荐理由:Claude Code 公布了新版本变更清单,读者可以据此核对 Sonnet 5.5 的默认接入、定价与缓存读取费用,并评估是否升级。