跳到正文
原文
微信公众号(Mp2RSS 合集)· 机器之心·· 2026-08-19精选AI 评分87

OpenAI 暂停最新前沿模型 RL 训练两周并公布安全新措施

突发!OpenAI停止强化学习训练两周

AI 导读

OpenAI 发文称已暂停其最新、计划用于部署的模型的强化学习训练两周,用于加固研究环境、红队测试并扩大内部监控,部分风险较低的训练已恢复,但原计划的最大规模前沿模型 RL 训练仍处暂停状态。

推荐理由

原文给出暂停 RL 训练的两个导火索和三层安全措施,读者可据此了解前沿训练为何把安全要求前移到训练阶段。

来源:微信公众号(Mp2RSS 合集) · mp.weixin.qq.com