Audio-Correction-Output-Test5
收藏资源简介:
该数据集是一个多模态数据集,包含音频和文本转录对。它由4个样本组成,仅包含训练集。每个样本包括以下字段:audio(音频数据)、text(文本内容)、transcription_corrigee(修正后的转录文本)、orthography(正字法标注)、source(数据来源)、duration(音频时长)、record_uuid(记录唯一标识符)和status(状态标识)。从字段推断,该数据集可能用于语音识别或语音转录任务,特别注重转录文本的校正过程,提供了原始转录和修正后转录的对比。数据规模较小,适合用于方法验证或小规模实验。
This is a multimodal dataset comprising audio-text transcription pairs. It includes only 4 samples and features a single training split. Each sample contains the following fields: audio (audio data), text (text content), transcription_corrigee (corrected transcription text), orthography (orthographic annotation), source (data source), duration (audio duration), record_uuid (unique record identifier), and status (status identifier). Based on its constituent fields, this dataset can be used for speech recognition or speech transcription tasks, with particular emphasis on the transcription correction process, as it provides a comparison between original and corrected transcriptions. With a small dataset scale, it is well-suited for method validation and small-scale experimental studies.
根据您提供的数据集详情页面README文件内容,以下是对该数据集的总结:
数据集概述
- 数据集名称: Audio-Correction-Output-Test5
- 数据集大小: 约296,506字节(约290 KB)
- 下载大小: 约300,626字节(约294 KB)
数据集结构
该数据集包含一个默认配置(default),仅有一个训练集(train)划分,包含4个样本。
数据特征
数据集包含以下8个特征字段:
| 字段名 | 数据类型 | 说明 |
|---|---|---|
audio |
音频(不解码) | 音频文件,存储为原始格式,不进行解码 |
text |
字符串 | 文本内容 |
transcription_corrigee |
字符串 | 校正后的转录文本 |
orthography |
字符串 | 正字法文本 |
source |
字符串 | 数据来源 |
duration |
字符串 | 音频时长 |
record_uuid |
字符串 | 记录的唯一标识符 |
status |
字符串 | 状态标签 |
数据用途
该数据集主要用于语音识别或音频校正相关任务,包含原始音频、原始文本与校正后文本的配对数据,可用于训练或测试音频校正模型。





