Last Translation Benchmark:用人工校验规则击破领先机器翻译模型
Last Translation Benchmark
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者推出 Last Translation Benchmark(LTB),收录经人工撰写与同行评审的文本、图像、音频、视频样本,专门用于击破领先机器翻译模型。每个样本附带手工编写的校验规则,描述该样本上的具体失败情形,从而支持可靠且可操作的评估。该基准为持续接收投稿的实时数据集,最新版本 LTBv1 收录 2026 年 9 月 1 日前接受的贡献。
来源:Hugging Face Daily Papers · arxiv.org