我花54小时做了个AI大模型共识排行榜,用Bradley-Terry算法聚合10个榜单
我花了54个小时,做了一个可能更公平的AI大模型排行榜。
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
作者在AIHOT上线了"模型榜",聚合首批10个排行榜数据,用Bradley-Terry成对比较加先验的方法(命名为LatentRank)推算模型综合能力值,并归一到100分制。榜单前5名中Opus 5超过Fable 5,作者称编程评测更强是主因。该功能免费开放,规则页与全部数据均已公开。
来源:数字生命卡兹克 · 微信公众号 · mp.weixin.qq.com