跳到正文
原文
OpenRouter Announcements·· 10 天前精选AI 评分61

OpenRouter 实测 Jev 1.13 与 Claude Opus 5 在 Banking77 分类任务上的准确率、延迟和成本

Is Jev as Accurate as Frontier Models at Classification?

AI 导读

OpenRouter 用 Banking77 测试集的 3,080 条客服语句对比 Jev 1.13 和 Claude Opus 5 的意图分类能力。

推荐理由

原文给出了同一测试集下的准确率、延迟和成本对比,以及置信度级联方案,可用于判断小判断模型能否替代前沿模型。

来源:OpenRouter Announcements · openrouter.ai