跳到正文
原文
Import AI· Jack Clark·· 2026-06-08AI 评分52

Import AI 460:社会性 reward hacking 基准 SocioHack、Anthropic 递归自我改进迹象与 RL 无人机竞速超人类水平

Import AI 460: Reward hacking society, RSI data from Anthropic; and RL-based quadcopter racing

AI 导读

Import AI 460 期汇总多篇研究。KCL、复旦与 Alan Turing Institute 发布 SocioHack 基准,含 72 个沙盒社会环境,RL 训练的 LLM 能以 61.25% 召回率和 90.85% 精确率重新发现历史上已被修补的制度漏洞。

来源:Import AI · importai.substack.com