遇见数据集

Simultaneous Interpretation Performance Dataset: EVS Analysis with Automatic Speech Recognition

收藏
Zenodo2025-06-15 更新2026-05-26 收录
官方服务:

资源简介:

This dataset contains comprehensive simultaneous interpretation (SI) performance data collected and analyzed using OpenAI Whisper automatic speech recognition. The dataset focuses on Ear-Voice Span (EVS) analysis, which measures the temporal lag between source speech input and interpreter output in English-Chinese simultaneous interpretation. ### Data Collection Methodology - **ASR Technology**: OpenAI Whispe - **Language Pair**: English-Chinese simultaneous interpretation - **Analysis Framework**: EVS temporal analysis, interpretation quality assessment, Chinese linguistic processing ### Dataset Contents - **ASR Recognition Results**: Word-level transcriptions with precise timestamps and confidence scores - **EVS Pairing Data**: Temporal alignment between English source and Chinese target segments - **Manual Corrections**: Human-edited transcriptions for improved accuracy - **Performance Metrics**: Comprehensive interpretation quality indicators and temporal dynamics ### Research Applications This dataset enables research in: - Simultaneous interpretation temporal dynamics - EVS pattern analysis in professional interpretation - Whisper ASR performance evaluation in interpretation contexts - Chinese linguistic processing in real-time interpretation - Interpretation quality assessment methodologies - Cognitive load analysis in simultaneous interpretation

提供机构:
Zenodo
创建时间:
2025-06-15
二维码
社区交流群
二维码
科研交流群
商业服务