跳到正文
原文
Anthropic Newsroom·· 2026-07-02精选AI 评分61

Anthropic 详解 Claude Fable 5 网络安全防护并发布越狱严重性框架草案

More details on Fable 5’s cyber safeguards and our jailbreak framework

AI 导读

Anthropic 宣布 Claude Fable 5 重新部署并面向全球所有用户开放,同时公布其网络安全安全分类器的细节和一份 AI 越狱严重性框架草案。分类器把网络安全用途分为禁止使用、高风险双用途、低风险双用途和良性使用四类,分别对应拦截、监控或放行,并设有比以往模型更大的安全边界。

推荐理由

Anthropic 披露 Fable 5 安全分类器的四类用途边界,并提出按能力增益与可利用性打分的越狱危害评级草案。

来源:Anthropic Newsroom · anthropic.com