人类在 4 万次游戏运行中审批 AI 智能体命令时漏掉三分之一威胁
Humans missed 1 in 3 threats approving AI agent commands across 40k game runs
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一项覆盖 4 万次游戏运行的测试显示,人类在审批 AI 智能体执行的命令时漏掉了三分之一的威胁。该结果来自对 AI 智能体命令审批环节的实测,人类审核者未能识别出约 1/3 的危险操作。
来源:scalex.dev(经 Hacker News) · scalex.dev