跳到正文
原文
OpenRouter Announcements·· 18 天前精选AI 评分62

OpenRouter Ori Eval 教程:用 LLM-as-a-Judge 自动评估 AI Agent 输出

LLM-as-a-Judge: Score AI Agent Outputs Automatically

AI 导读

OpenRouter 发布教程,讲解如何用独立的 judge 模型按书面评分标准自动给 Agent 输出打分,弥补确定性测试无法检查最终回答质量的问题。

推荐理由

原文给出可复用的评测方法和 Ori Eval 具体代码,覆盖评分模式选择与 judge 校准的实操细节。

来源:OpenRouter Announcements · openrouter.ai