推荐理由:官方说明 Claude Cowork 和 Claude Code 能在后台操作电脑,并展示了应用授权入口,读者可据此判断这类电脑操作智能体的可用边界。
Agent 智能体
全部主题让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。
当前仅显示精选新闻最新精选
第 261–280 条 · 共 847 条@claudeai@claudeai精选AI 评分7777 
Claude Blog精选AI 评分6666 Anthropic 发布商业智能体构建指南与参考实现
Anthropic 发布一份商业智能体构建指南,并开源参考实现 anthropics/commerce-agents,内含零售、旅游、电信和票务平台的购物智能体与商家智能体示例。
推荐理由:Anthropic 给出商业智能体的三层架构与可运行参考实现,读者可据此对照自身的技能划分与评测设计。
Claude Blog精选AI 评分6363 Anthropic 发布 Claude 商务智能体蓝图,含购物与商家智能体参考实现
Anthropic 发布用于构建 commerce agents 的蓝图,包含让工程团队在数天内跑起商务智能体所需的 harness、模式与护栏,并提供零售、旅行、电信和票务场景的购物智能体与商家智能体参考实现。
推荐理由:Anthropic 公开 commerce agents 蓝图与参考实现,开发者可据此判断商务智能体的落地路径与部署选择。
@OpenRouter@OpenRouter精选AI 评分6565 推荐理由:OpenRouter 为视频输入新增 agentic 处理选项,模型可自行浏览时间线,替代固定帧率采样。
@fofrAI@fofrAI精选AI 评分7474 引用@GoogleDeepMind@GoogleDeepMindTwo new Gemini models are here to help scale your AI agents and secure code: 🔘 3.8 Flash: our most intelligent model yet with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning. 🔘 3.8 Flash Cyber: our most capable cybersecurity model with frontier-level vulnerability detection and automated patching.
推荐理由:Google 一次发布两款 Gemini 3.8 Flash 模型,分别面向智能体任务与代码安全,可对照 3.7 Flash 看提升方向。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款模型
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber。
推荐理由:官方给出具体基准数据和定价,可用于对比 3.7 Flash 判断升级性价比,Cyber 版的开放范围也值得安全团队留意。
@omarsar0@omarsar0精选AI 评分6767 
引用@GoogleDeepMind@GoogleDeepMindTwo new Gemini models are here to help scale your AI agents and secure code: 🔘 3.8 Flash: our most intelligent model yet with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning. 🔘 3.8 Flash Cyber: our most capable cybersecurity model with frontier-level vulnerability detection and automated patching.
推荐理由:随推附上的对比表把 Gemini 3.8 Flash 的定价与多项基准成绩与 Claude、GPT-5.6 并列,便于横向比较。
@OfficialLoganK@OfficialLoganK精选AI 评分6565 



推荐理由:原文列出 Gemini 3.8 Flash 的价格与多项基准对比,读者可据此判断其智能体和编码能力相较前代及竞品的位置。
@GoogleAI@GoogleAI精选AI 评分7474 推荐理由:原文列出 3.8 Flash 在订阅端、开发者工具和企业平台的具体开放入口,读者可据此判断自己能否用上。
@GoogleDeepMind@GoogleDeepMind精选AI 评分6767 
推荐理由:官方列出两款 3.8 Flash 的定位差异与相对 3.7 Flash 的提升方向,便于判断编码与安全场景的选型。
@GoogleDeepMind@GoogleDeepMind精选AI 评分6565 
推荐理由:官方公布了 Fairwind 计划与 Gemini 3.8 Flash 的推送渠道,读者可据此了解面向政府和关键基础设施的接入方式。
@frxiaobei@frxiaobei精选AI 评分6767 推荐理由:Cognition 三个月内年化收入从约 4.92 亿美元增至超 9 亿美元,估值接近翻倍,可作为观察 AI Coding Agent 商业化的样本。
Cursor Blog精选AI 评分7272 Cursor 发布自托管机器,云端智能体可在自有基础设施上运行
Cursor 发布自托管机器功能,云端智能体可以运行在团队自管的机器资源池上,智能体循环、推理与规划仍留在 Cursor 云端。工具执行则转移到自有环境中的机器:安装 Cursor CLI 并运行 agent worker start 建立通往 Cursor 云端的出站 HTTPS 长连接,Cursor 从不主动向用户网络发起连接。
推荐理由:自托管机器把工具执行环境交回团队自有基础设施,推理与编排仍留在 Cursor 云端,读者可据此判断适用边界。
Cursor Blog精选AI 评分6767 Cursor 推出自托管机器,云端智能体可在自有基础设施上运行
Cursor 发布自托管机器功能,云端智能体的工具执行可迁移到团队自管的基础设施上,而智能体循环、推理和规划仍留在 Cursor 云端。
推荐理由:官方给出自托管机器的适用场景判断方法和扩缩容、休眠等机制细节,团队可以据此评估智能体是否迁入自有基础设施。
@kimmonismus@kimmonismus精选AI 评分6666
引用@Alibaba_Qwen@Alibaba_Qwen🚀Qwen3.8-Max just got upgraded. Meet Qwen3.8-Max-0902! 2.4T parameters. 1M context tokens. Built for real world complexity. Further post trained on Coding & Cowork, Qwen3.8-Max-0902 now delivers stronger performance across complex enterprise tasks, scientific research, and long horizon workflows. 💰Pricing per 1M tokens: $2 input, $6 output. $0.17 explicit cache hit, $0.25 implicit cache hit. Now live via API on QwenCloud. Come try it! 🙌 API: https://t.co/dq3WgMk980
推荐理由:材料给出 Qwen3.8-Max-0902 的参数、上下文与定价,作者由此讨论版本迭代节奏和中美实验室差距的缩小。
AI寒武纪 · 微信公众号精选AI 评分7777 Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1 双旗舰模型,缓存读取价格降 75%
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1 两款底层架构相同、安全防护等级不同的模型,Fable 5.1 面向大众开放,Mythos 5.1 仅通过可信访问计划向特定机构开放。
推荐理由:缓存读取价格下调75%并给出分子设计与金星地形重建案例,便于对比新旗舰的能力与成本结构。
@AYi_AInotes@AYi_AInotes精选AI 评分6767
引用@Alibaba_Qwen@Alibaba_Qwen🚀Qwen3.8-Max just got upgraded. Meet Qwen3.8-Max-0902! 2.4T parameters. 1M context tokens. Built for real world complexity. Further post trained on Coding & Cowork, Qwen3.8-Max-0902 now delivers stronger performance across complex enterprise tasks, scientific research, and long horizon workflows. 💰Pricing per 1M tokens: $2 input, $6 output. $0.17 explicit cache hit, $0.25 implicit cache hit. Now live via API on QwenCloud. Come try it! 🙌 API: https://t.co/dq3WgMk980
推荐理由:列出新版 Qwen 在代码榜单的排位与每百万 tokens 定价,可据此评估替换现有 Agent 底座的成本。
AGI Hunt · 微信公众号精选AI 评分7777 Anthropic 发布 Fable 5.1 提示词指南,列出 15 处行为差异
Anthropic 在 Fable 5.1 发布同日推出官方提示词指南,逐条列出该模型与 Fable 5 的 15 处行为差异,并为每条附上可直接复制的修正提示词。
推荐理由:指南逐条解释新旧模型的行为差异并附可直接复制的修正提示词,便于对照清理旧 prompt 中的过时补丁。
@rohanpaul_ai@rohanpaul_ai精选AI 评分6565 METR 在安全更新中披露,一名研究员个人 EC2 实例上运行的智能体被直接提示交出 provider key,攻击者用盗取的密钥在三周内消耗了价值 $600,000 的免费 AI credits。

推荐理由:METR 披露的这起安全事件,展示了智能体持有长期密钥时身份验证与额度管控的具体失效环节。
@rohanpaul_ai@rohanpaul_ai精选AI 评分7676 
推荐理由:对比其三个月前 $26B 估值和 $492M 年化收入的融资,可以看出这轮估值与收入的同步抬升节奏。