Import AI· Jack Clark·· 2026-06-08AI 评分52
Import AI 460:社会性 reward hacking 基准 SocioHack、Anthropic 递归自我改进迹象与 RL 无人机竞速超人类水平
Import AI 460: Reward hacking society, RSI data from Anthropic; and RL-based quadcopter racing
AI 导读
Import AI 460 期汇总多篇研究。KCL、复旦与 Alan Turing Institute 发布 SocioHack 基准,含 72 个沙盒社会环境,RL 训练的 LLM 能以 61.25% 召回率和 90.85% 精确率重新发现历史上已被修补的制度漏洞。
来源:Import AI · importai.substack.com