原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2609.04173
立即前往原文

Last Translation Benchmark 挑战最新翻译模型的能力极限

Last Translation Benchmark(LTB)是一套由人类编写并经过同行评审的文本、图像、音频和视频集合,用于揭示主流机器翻译模型的失败案例。随着传统翻译基准逐渐接近饱和,自动评估指标容易受到奖励劫持影响,也难以提供可执行的改进方向。LTB为每个样例配备人工制定的验证规则,具体说明可能出现的错误,从而支持更可靠、可复现且具有实际指导意义的后续评估。该基准是一个持续更新并接受新贡献的动态数据集。目前的LTBv1版本收录了截至2026年9月1日前获接受的贡献。
行业资讯 AI模型 研究 2026-09-05 09:30:56 723 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。