跳到正文
@frxiaobei· @frxiaobei · X·· 24 天前AI 评分49
AI 导读

Anthropic 的 Dario 判断 AI 能力提升速度已超过人类理解与控制它的速度,尤其当 AI 参与下一代 AI 研发,模型迭代可能从几年一代压缩到几个月甚至更短。他提出三步方案:让独立评估机构以接近员工权限长期进驻前沿实验室、推动主要 AI 公司形成共同安全标准、最终在全球范围协调包括与中国达成可验证共识,Anthropic 已承诺先执行第一步。

正文

虽然 Anthropic 这家公司总不干人事,但 Dario 这篇文章,还是值得认真看一下。

他的判断很直接,AI 能力提升的速度,已经开始超过人类理解和控制它的速度。

尤其当 AI 逐渐参与下一代 AI 的研发,模型进步可能从几年一代,压缩到几个月甚至更短。

继续完全按照商业竞争的节奏往前冲,安全研究、监管和社会适应都会被甩在后面。

他提出了三步:
1. 先让独立评估机构长期进入前沿实验室,获得接近员工级别的权限;
2. 再推动主要 AI 公司形成共同的安全标准;
3. 最后尝试在全球范围内协调,包括与中国达成某种可验证的共识。

Anthropic 已经承诺先执行第一步。

这里面当然有商业算计。
越是头部公司呼吁提高安全门槛,越要警惕这些门槛最终变成它们自己的护城河。

Dario 一边主张全球减速,一边又要求限制中国获得芯片、模型权重和蒸馏能力,这套逻辑也谈不上纯粹。

但动机复杂,不代表事情本身没有价值。
让第三方长期进入公司内部,看到模型训练、安全评估和事故处理的真实过程,比企业自己发布几份安全报告更进一步。

AI 公司总在告诉外界,他们正在创造一种可能改变人类命运的技术。
如果这句话是真的,它们接受的监督,也应该配得上这句话。

PS:我是不是可以成为第三方评估人员,请 Anthropic 主动来联系一下。

来源:@frxiaobei · x.com