LAIT (Literary AI Translation)
收藏资源简介:
LAIT是一个用于文学机器翻译读者中心评估的公共研究发布数据集,包含三个机器翻译流水线的输出和用于比较机器翻译与人工翻译的聚合分析。数据集不包括源文本或人工翻译,这些材料需通过电子邮件请求访问或通过需同意访问条款的gated Hugging Face数据集获取。
LAIT is a publicly released research dataset for reader-centered evaluation of literary machine translation. It contains outputs from three machine translation pipelines and aggregated analyses for comparing machine translations against human translations. The dataset does not include source texts or human translations; these materials can be accessed via email request or through the gated Hugging Face dataset that requires agreement to the access terms.
数据集概述
LAIT(Literary AI Translation) 是一个面向文学机器翻译的读者中心评估研究的公开研究数据集。该仓库聚焦于研究中讨论的三个机器翻译流水线(P1、P2、P3)及其与人工翻译的比较分析结果。
数据集内容
主要公开输出
-
机器翻译输出:三个流水线的翻译结果按模型分组存放:
books/MT/pipeline1/:第一个MT流水线输出(按模型分组)books/MT/pipeline2/:第二个MT流水线输出(按模型分组)books/MT/pipeline3/:代理型MT流水线输出(包括附录中多语言目标语言示例,位于extern/下)
-
分析输出:
analysis/manuscript_tables/:派生LaTeX/CSV表格(文本字段已酌情编辑)human_eval/:人工评估图表、聚合模型输出和计数摘要(行级评论和注释导出被保留)results_all_metrics/、results_chunk_review_eval/、results_mapped_metrics/:派生指标输出(源文本/HT文本字段已酌情编辑)
-
代码与配置:所有代码、提示、配置文件、测试和文档均为公开内容。
未公开内容(需申请访问)
- 源语言文本
- 人工翻译
- 原始源文本/HT块级评审输入
- 包含源文本块的工作运行目录
- 原始人工评估导出和内部研究数据
- 行级参与者评论、注释导出和差异查看器
这些材料可通过联系作者获取研究访问权限,后续将通过需同意访问条款的Hugging Face数据集分发。
数据集用途
- 评估文学机器翻译质量,比较机器翻译与人工翻译。
- 分析多种自动指标和人工评估结果。
- 复现研究:提供代码入口点用于运行MT流水线、评分自动指标和检查分析脚本。
代码与使用
| 任务 | 入口点 |
|---|---|
| 运行直接MT流水线 | python mt_pipeline.py --help |
| 运行代理型MT流水线 | python agents_pipeline/runner.py --help |
| 用自动指标评分MT输出 | python mt_eval.py --help |
| 运行旧版评估包装器 | python eval_pipeline.py --help |
| 检查分析脚本 | analysis/scripts/ |
| 检查工具脚本 | scripts/ |
- 环境要求:Python 3.10+,通过
requirements.txt安装依赖。 - 配置文件:复制
.env.example为.env并填写所需凭证,禁止提交.env文件。
许可证
- 仓库代码和文档采用 MIT许可证(除非文件或子目录另有声明)。
- 第三方组件保留其自身许可证(包括
par3/、metricx/和LiTransProQA/)。
相关链接




