跳到正文
scalex.dev(经 Hacker News)·· 2026-08-06AI 评分35

人类在 4 万次游戏运行中审批 AI 智能体命令时漏掉三分之一威胁

Humans missed 1 in 3 threats approving AI agent commands across 40k game runs

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

一项覆盖 4 万次游戏运行的测试显示,人类在审批 AI 智能体执行的命令时漏掉了三分之一的威胁。该结果来自对 AI 智能体命令审批环节的实测,人类审核者未能识别出约 1/3 的危险操作。

来源:scalex.dev(经 Hacker News) · scalex.dev