跳到正文
MarkTechPost· Michal Sutter·· 20 天前AI 评分68

OpenAI 发布模型失准披露框架,含 3 条审查路径与 6 份 RL 训练事件报告

OpenAI Releases a Model Misalignment Disclosure Framework With 3 Review Tracks and 6 Incident Reports From RL Training

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

OpenAI 发布模型失准披露框架,为其模型在训练、评测、测试和部署中出现的失准行为设定披露标准与截止时限,并同时公布 6 份来自强化学习训练的事件报告。框架将上报案例分流到 3 条审查路径,OpenAI 表示首批 6 份报告均落在前两条路径内,未解决的争议交由安全咨询小组处理。

来源:MarkTechPost · marktechpost.com