OmnisBench:可在全新任务上重评分的开放式 LLM 路由基准测试
Show HN: OmnisBench:一个可在全新任务上进行可重评分的开放式大型语言模型路由基准测试
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
OmnisBench 是一个开放式、可重评分的 LLM 路由基准测试,主打在全新任务上评估模型路由效果。项目已发布在 GitHub,供社区使用与复现。
来源:github.com(经 Hacker News) · github.com
Show HN: OmnisBench:一个可在全新任务上进行可重评分的开放式大型语言模型路由基准测试
本站未展示全文,请前往来源网站阅读。
OmnisBench 是一个开放式、可重评分的 LLM 路由基准测试,主打在全新任务上评估模型路由效果。项目已发布在 GitHub,供社区使用与复现。
来源:github.com(经 Hacker News) · github.com