OpenRouter Announcements·· 10 天前精选AI 评分61
OpenRouter 实测 Jev 1.13 与 Claude Opus 5 在 Banking77 分类任务上的准确率、延迟和成本
Is Jev as Accurate as Frontier Models at Classification?
AI 导读
OpenRouter 用 Banking77 测试集的 3,080 条客服语句对比 Jev 1.13 和 Claude Opus 5 的意图分类能力。
推荐理由
原文给出了同一测试集下的准确率、延迟和成本对比,以及置信度级联方案,可用于判断小判断模型能否替代前沿模型。
来源:OpenRouter Announcements · openrouter.ai