跳到正文
@berryxia· @berryxia · X·· 2026-05-13AI 评分47
AI 导读

AIIQ.org 上线,用真实基准数据为流行大模型估算 IQ 与 EQ 分数,并提供 IQ vs 成本、IQ vs EQ 及 3D 性价比对比图。该站将 12 个硬核基准分为抽象、数学、编程、学术四个维度,保守填补缺失数据后给出标准正态分布上的 IQ 分数;EQ 则由 EQ-Bench 与 Arena Elo 加权计算,并对 Anthropic 模型施加 200 分惩罚。

正文

一起来看看大模型的IQ和EQ排名😂

大家还在疯狂卷参数、卷基准分数的时候,有人直接给AI模型打起了IQ分。

AIIQ. org 刚刚上线,把流行大模型全部拉出来,用真实基准数据智能估算IQ和EQ,还做了IQ vs 成本、IQ vs EQ、3D性价比对比图,清晰到离谱。

它把12个硬核基准分成抽象、数学、编程、学术四个维度,保守填补缺失数据,最后给出标准正态分布上的IQ分数。

EQ也用EQ-Bench和Arena Elo加权计算,甚至对Anthropic模型做了200分惩罚。

这已经不是简单的“谁更强”排行榜,而是真正开始用人类智力标准去衡量AI的时代。

真正拉开差距的,从来不是谁的参数最大,而是谁先学会用更聪明的方式去评估和选择模型。

网站👉 aiiq.org

来源:@berryxia · x.com