Simultaneous Interpretation Performance Dataset: EVS Analysis with Automatic Speech Recognition
收藏资源简介:
This dataset contains comprehensive simultaneous interpretation (SI) performance data collected and analyzed using OpenAI Whisper automatic speech recognition. The dataset focuses on Ear-Voice Span (EVS) analysis, which measures the temporal lag between source speech input and interpreter output in English-Chinese simultaneous interpretation. ### Data Collection Methodology - **ASR Technology**: OpenAI Whispe - **Language Pair**: English-Chinese simultaneous interpretation - **Analysis Framework**: EVS temporal analysis, interpretation quality assessment, Chinese linguistic processing ### Dataset Contents - **ASR Recognition Results**: Word-level transcriptions with precise timestamps and confidence scores - **EVS Pairing Data**: Temporal alignment between English source and Chinese target segments - **Manual Corrections**: Human-edited transcriptions for improved accuracy - **Performance Metrics**: Comprehensive interpretation quality indicators and temporal dynamics ### Research Applications This dataset enables research in: - Simultaneous interpretation temporal dynamics - EVS pattern analysis in professional interpretation - Whisper ASR performance evaluation in interpretation contexts - Chinese linguistic processing in real-time interpretation - Interpretation quality assessment methodologies - Cognitive load analysis in simultaneous interpretation



