百万人的母语竟无翻译基准!谷歌DeepL全缺席,600条目基准2026年首发
The Ongiini-Eval-OW Benchmark: A Concept Paper for the Planned Benchmarking of Machine Translation and Large Language Models on Oshindonga and Oshikwanyama
arXiv CL (cs.CL) #机器翻译#低资源语言#评测基准 🕐 今天 12:00

📖 AI 总结

本文是一篇概念论文,宣布计划构建名为Ongiini-Eval-OW的机器翻译与大语言模型评测基准,聚焦纳米比亚和安哥拉南部逾百万人使用的奥希万博语(Oshiwambo)语组中的两种标准方言——奥辛东加语(Oshindonga)和奥希宽亚马语(Oshikwanyama)。作者指出,目前主流商业翻译服务、开源多语模型及Masakhane模型集合均未覆盖这两种方言,相关评测基准处于空白状态。该基准计划包含600条英-奥辛东加语和英-奥希宽亚马语测试项,由两位独立母语译者提供参考译文,并设置译者一致性校验集、11类语言现象分层标注、30%盲测划分,以及基于chrF++、BLEU和COMET-22的可复现评分协议和50项人工评估。数据集预计2026年第四季度首次公开发布,数据与代码分别采用CC-BY-4.0和MIT许可。

🔑 关键词速览

Oshiwambo奥希万博语,一组在纳米比亚北部和安哥拉南部使用的班图语,包含奥辛东加语和奥希宽亚马语等方言。
Oshindonga奥辛东加语,奥希万博语的一种标准化方言,是纳米比亚的主要语言之一。
Oshikwanyama奥希宽亚马语,奥希万博语的另一种标准化方言,与奥辛东加语可相互通话。
chrF++一种基于字符n-gram的机器翻译评估指标,是chrF的扩展版本,同时考虑词和字符级别的匹配。
COMET-22一种基于神经网络的机器翻译评估指标,COMET-22是其2022年版本,通过预训练模型预测翻译质量。
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅