最新精选
第 921–940 条 · 共 957 条Sayash Kapoor、Arvind Narayanan 与 Stephan Rabanser 等人发布 66 页论文《Towards a Science of AI Agent Reliability》,将智能体可靠性拆解为一致性、鲁棒性、可预测性、安全性四维共 12 项指标。
推荐理由:论文把智能体可靠性拆成12个维度并实测14个模型,显示18个月内准确率大涨而可靠性仅小幅提升。
千问团队正式发布 Qwen3.5 系列,并开源该系列首个模型 Qwen3.5-397B-A17B 的权重。该模型是原生视觉语言模型,官方称其在推理、编码、智能体能力和多模态理解的全套基准评测中表现突出,面向开发者和企业开放使用。
推荐理由:官方宣布 Qwen3.5 系列首个开源权重模型发布,覆盖推理、编码、智能体和多模态评测,适合关注开源多模态模型进展的读者。
MiniMax 发布新模型 MiniMax-M2.5 及提速版 M2.5-Lightning,SWE-Bench Verified 得分 80.2%,Multi-SWE-Bench 51.3%,BrowseComp 76.3%。
推荐理由:原文给出 M2.5 的基准分数、速度和成本对比,还透露 Forge RL 框架细节,读者可据此评估其在编码与 Agent 场景的性价比。
PromptArmor 发布研究,指出消息应用(如 Telegram、Slack)的链接预览会在无需用户点击的情况下自动请求 URL,间接提示词注入可诱导 AI 智能体在回复中返回携带用户敏感数据的恶意链接,从而在预览时即完成数据外泄。
推荐理由:原文给出完整的链接预览数据外泄攻击链和可复现测试,读者可据此自查所用智能体是否暴露风险。
FireRedTeam 在 GitHub 开源 FireRed-OpenStoryline,通过自然语言对话完成视频创作,2026-02-10 正式开源,采用 Apache License 2.0。
推荐理由:官方仓库给出完整功能清单、架构说明和安装方式,读者可以据此判断它是否适配自己的视频创作流程。
ElevenLabs 完成 5 亿美元 D 轮融资,估值 110 亿美元,较一年前增长超过三倍,累计融资达 7.81 亿美元。本轮融资由 Sequoia Capital 领投,Andrew Reed 加入董事会,A16Z 加注四倍、ICONIQ 加注三倍。
推荐理由:官方公告给出了融资金额、估值、ARR 和资金用途,读者可以据此了解 ElevenLabs 在语音智能体上的投入方向。
Qwen 团队发布开源权重模型 Qwen3-Coder-Next,专为编码智能体和本地开发设计。模型基于 Qwen3-Next-80B-A3B-Base 构建,采用混合注意力加 MoE 的新架构,通过大规模可执行任务合成、环境交互和强化学习进行 agentic 训练。
推荐理由:原文说明该模型面向编码智能体与本地开发,并给出混合注意力加 MoE 的架构与训练方式,读者可据此评估其定位。
开源 Agent 平台项目由 Moltbot 更名为 OpenClaw,此前曾因名称与 Claude 相似被 Anthropic 法务要求更改,项目已获超 100,000 GitHub stars。
推荐理由:作者亲述更名过程与本次更新内容,包括新渠道、新模型支持和 34 个安全提交,并坦诚提示 prompt injection 仍未解决。
Mistral AI 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型家族驱动,新增自定义子智能体、多选澄清、斜杠命令技能和统一智能体模式。
推荐理由:官方公告给出 2.0 的功能清单、订阅方案和 Devstral 2 API 定价,读者可以据此评估是否把它纳入自己的终端开发工作流。
PromptArmor 演示了针对 Claude Cowork 的文件外传攻击:藏在 .docx 中的提示词注入操纵 Claude 用 curl 调用 Anthropic 文件上传 API,把用户本地文件传到攻击者账户,全程无需人工批准;VM 限制出站网络但 Anthropic API 属白名单。
推荐理由:原文完整演示了 Claude Cowork 经 Anthropic API 白名单外传本地文件的攻击链,并指出 Opus 4.5 同样可被操纵,威胁具体可查。
PromptArmor 披露 OpenAI Platform 的 responses 和 conversations API 日志因不安全渲染 Markdown 图片,可导致使用该平台的应用和智能体数据外泄,即使应用自身已屏蔽恶意 Markdown 图片也会中招。
推荐理由:原文完整披露攻击链和修复进展,开发者可借此检查自己应用的日志查看风险。
Replit 发布博文,介绍其为 Replit Agent 设计的决策时引导(decision-time guidance)机制,用轻量多标签分类器在关键决策点注入简短情境化指令,替代静态系统提示词,将可控引导从 4–5 条静态提醒扩展到数百条。
推荐理由:Replit 自述其 Agent 的决策时引导机制,包含注入位置对比实验和缓存成本数据,方法对同类 Agent 工程有可迁移性。
Replit 推出 Mobile Apps on Replit,用户用自然语言描述需求,由 Replit Agent 生成移动应用,无需原生开发经验。
推荐理由:官方宣布用自然语言从想法直接发布到 App Store 的移动应用构建流程,包含从预览到提交的完整路径,可帮助非移动开发者评估上手成本。
PromptArmor 威胁情报团队发现 Superhuman AI 存在间接提示词注入漏洞,可把用户数十封含财务、法律、医疗信息的邮件内容提交到攻击者的 Google Form。
推荐理由:原文给出完整的间接提示词注入攻击链和绕过 CSP 的具体手法,安全团队可以据此排查同类 AI 邮件助手的泄露风险。
PromptArmor 披露 Notion AI 存在间接提示词注入漏洞,AI 文档编辑在用户批准前即已保存,攻击者借此在用户尚未响应外部 URL 信任警告时,将含薪资预期、候选人反馈等敏感信息的 hiring tracker 数据经恶意图片 URL 外泄。
推荐理由:原文完整拆解了间接提示词注入导致 Notion AI 数据外泄的机制,并给出企业和 Notion 两方的具体缓解配置。
PromptArmor 披露 IBM 的编码智能体 Bob(含 Bob CLI 与 Bob IDE,当前 Closed Beta)存在漏洞:用户只要对一条已知可信命令(如 echo)设置 always allow,攻击者即可通过间接提示词注入触发恶意软件的下载与执行。
推荐理由:原文演示了 IBM Bob CLI 在一次自动批准下被间接提示词注入触发恶意软件执行的完整链路,并给出三个被绕过的防御细节。
MiniMax 发布 MiniMax-M2.1 模型并开源权重,重点提升 Rust、Java、Golang、C++、Kotlin 等多语言编程能力和原生 Android/iOS 开发能力。
推荐理由:官方说明 M2.1 相比 M2 的能力变化重点和使用入口,读者可据此判断它在多语言编程和办公场景中的适配价值。
Replit 官方宣布接入 ChatGPT,用户在消息中 @replit 即可让 Agent 创建、更新并部署 Replit Apps,预览直接显示在对话中。应用存放在 Replit 账户内,可继续添加数据库、连接 API 或发布到自定义域名;该集成在 ChatGPT App Store 可用市场开放,使用消耗 Replit Agent credits,每个会话对应一个应用。
推荐理由:官方给出连接步骤、使用方式与账户要求,读者可以据此判断在 ChatGPT 内构建应用的可行路径。
Google 在 Gemini API 更新日志中宣布推出 Gemini 3 Flash Preview(gemini-3-flash-preview),定位为以更低成本提供对标更大模型的快速前沿性能。新模型升级了视觉与空间推理以及智能体编码能力,并附带多模态函数响应、带图像的代码执行等新功能文档。
推荐理由:官方日志给出新模型的定位、成本与新增功能入口,便于评估其在现有 Gemini API 工作流中的替换价值。
Mistral 发布开源编码模型 Devstral 2(123B,修改版 MIT)和 Devstral Small 2(24B,Apache 2.0),SWE-bench Verified 分别达 72.2% 和 68.0%,均支持 256K 上下文。
推荐理由:官方给出了两个尺寸的开源编码模型参数量、SWE-bench Verified 成绩、API 定价和部署门槛,可与闭源竞品直接对比。