LOL Bench:衡量 LLM 能否理解笑话的基准测试
Show HN: LOL Bench——衡量大型语言模型能否理解笑话的基准测试
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
LOL Bench 是一个衡量大语言模型能否理解笑话的基准测试,项目地址为 lolbench.lol,并以 Show HN 形式发布。该基准聚焦于测试 LLM 对幽默的理解能力,目前未披露具体评测模型、分数或数据集规模。
来源:lolbench.lol(经 Hacker News) · lolbench.lol