relate_ovl
收藏资源简介:
该数据集包含音频样本,每个样本提供波形文件名(wave_filename)、评分(score)和推理文本(reasoning),以及可选的文本(text)、音频类型(audio_type)和注释数量(num_annotations)字段。训练集共有 2862 个样本,数据集大小约 2.75 MB,适用于音频质量评估、音频分类或相关推理任务。
This dataset contains audio samples, each providing a waveform filename (wave_filename), score, and reasoning text, with optional fields for text, audio type (audio_type), and number of annotations (num_annotations). The training set comprises 2862 samples, with a dataset size of approximately 2.75 MB, suitable for audio quality assessment, audio classification, or related reasoning tasks.
数据集概述
数据集名称:relate_ovl
数据集地址:https://huggingface.co/datasets/AutoAudioReasoningMOS/relate_ovl
数据集简介:该数据集主要用于音频相关的自动推理任务,结合了音频质量评分与文本推理描述,属于语音/音频评估领域的数据资源。
数据特征(Features)
| 字段名 | 数据类型 | 说明 |
|---|---|---|
text |
null(未明确指定) | 可能为文本转录或提示文本 |
audio_type |
null(未明确指定) | 音频类型分类 |
num_annotations |
null(未明确指定) | 标注数量 |
wave_filename |
string(字符串) | 音频文件名 |
duration |
null(未明确指定) | 音频时长 |
score |
float64(浮点数) | 音频质量评分 |
reasoning |
string(字符串) | 推理或评分理由描述 |
数据集划分(Splits)
| 划分名称 | 样本数量 | 字节大小 |
|---|---|---|
train(训练集) |
2862 | 2,747,711 字节(约2.62 MB) |
文件信息与配置
- 下载大小:1,152,998 字节(约1.10 MB)
- 数据集总大小:2,747,711 字节(约2.62 MB)
- 配置文件:默认配置(
default)- 数据文件路径:
data/train-*(通配符匹配多个分片文件)
- 数据文件路径:
数据用途与说明
该数据集结合了客观评分(score)与主观推理描述(reasoning),可用于训练或评估音频质量评估模型、生成音频质量解释文本,以及进行音频相关的多模态推理任务。每个样本包含音频文件引用(wave_filename)、文本内容及对应的评分和推理依据,适用于有监督的回归或生成任务。




