Biomedical MQM Dataset
收藏资源简介:
The dataset is based on system submissions from 21 participants to the WMT21 bio translation shared task (Yeganova et al., 2021), which is in turn based on bilingual academic paper abstracts in the MEDLINE corpus retrieved from National Library of Medicine (NLM). Reference translations and MQM annotations were created on top of the shared task dataset by expert linguists with experience in the medical domain.
本数据集以21位参与者提交至WMT21生物医学翻译共享任务(Yeganova等人,2021)的系统译文为基础。该共享任务的语料源自从美国国家医学图书馆(National Library of Medicine, NLM)获取的MEDLINE医学文献语料库中的双语学术论文摘要。随后,拥有医学领域专业经验的语言学家基于该共享任务数据集,生成了参考译文与多维质量度量(Multi-Dimensional Quality Metric, MQM)标注。
Biomedical MQM Dataset 概述
数据集描述
- 名称: Biomedical MQM Dataset
- 来源: 基于 WMT21 bio 翻译共享任务的系统提交(Yeganova et al., 2021),数据源自 MEDLINE 库的双语学术论文摘要。
- 内容: 包含11种语言对的生物医学领域多维质量指标(MQM)标注数据集。
- 目的: 用于研究机器翻译(MT)指标在训练和推理领域转移中的稳健性。
数据集构成
- 基础数据: 来自21个参与者的系统提交,基于MEDLINE库的双语学术论文摘要。
- 标注数据: 由具有医学领域经验的专家语言学家创建的参考翻译和MQM标注。
数据集使用
-
访问方式: 数据集可通过 此链接 访问。
-
引用信息:
@article{zouhar2024finetuned, title={Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains}, author={Vilém Zouhar and Shuoyang Ding and Anna Currey and Tatyana Badeka and Jenyuan Wang and Brian Thompson}, year={2024}, eprint={2402.18747}, archivePrefix={arXiv}, journal={arXiv preprint arXiv:2306.07899}, url={https://arxiv.org/abs/2402.18747} }
数据集统计
- 测试集:
- 语言对: de-en, en-de, en-es, en-fr, en-ru, en-zh, es-en, fr-en, ru-en, zh-en
- 总行数: 19191
- 开发集:
- 语言对: br-en, de-en, en-de, en-es, en-fr, en-ru, en-zh, es-en, fr-en, ru-en, zh-en
- 总行数: 6069
- 通用测试集:
- 语言对: en-de, en-ru, zh-en
- 总行数: 59957
数据集应用
- 研究方向: 评估机器翻译指标在不同领域间的性能变化,特别是领域转移对性能的影响。
- 实验设置: 包括基线模型评估、MQM模型适应性训练、LM适应性实验等。
数据集版本
- 版本: v1
- 存储位置: ${ADAPTATION_ROOT}/data/raw/wmt21-biomed-mqm/




