PheMT: A Phenomenon-wise Dataset for Machine Translation Robustness on User-Generated Contents
PheMT:一种用于用户生成内容机器翻译鲁棒性的现象性数据集
机构 * Tohoku University(东北大学) ; RIKEN(日本科学技术研究所) ; NTT Communication Science Laboratories(NTT通信科学实验室)
AI总结 本文提出PheMT数据集,用于评估机器翻译系统在日英翻译中对特定语言现象的鲁棒性,实验表明现有模型和商用系统均受特定现象影响。
Comments 15 pages, 4 figures, accepted at COLING 2020
Journal ref Proceedings of the 28th International Conference on Computational Linguistics, pages 5929-5943, 2020