遇见数据集

FusionAudio-4

收藏
魔搭社区2026-07-18 更新2025-06-28 收录
官方服务:

资源简介:

# Audio Caption Dataset ## Dataset Description This dataset contains audio captions from the dataset, including: - Audio captions - Speech captions - Music captions (where available) - Audio files and metadata ## Dataset Structure The dataset contains the following columns: - `id`: Unique identifier for each audio sample - `audio_caption`: Description of the audio content - `speech_caption`: Description of speech content - `music_caption`: Description of music content (may be empty) - `path`: Relative path to the audio file - `url`: Original URL (if available) - `timeinterval`: Time interval information - `audio`: Audio data ## Usage ```python from datasets import load_dataset # Load the dataset dataset = load_dataset("tzzte/FusionAudio-4") # Access a sample sample = dataset["train"][0] print(sample["audio_caption"]) ```

# 音频字幕数据集(Audio Caption Dataset) ## 数据集说明 本数据集收录各类音频字幕数据,具体包含: - 音频字幕 - 语音字幕 - 音乐字幕(仅当数据源可用时提供) - 音频文件与元数据(metadata) ## 数据集结构 本数据集包含以下字段: - `id`:每个音频样本的唯一标识符 - `audio_caption`:音频内容的描述文本 - `speech_caption`:语音内容的描述文本 - `music_caption`:音乐内容的描述文本(可为空) - `path`:音频文件的相对存储路径 - `url`:原始资源链接(若可用) - `timeinterval`:时间间隔信息 - `audio`:音频数据 ## 使用方法 python from datasets import load_dataset # 加载数据集 dataset = load_dataset("tzzte/FusionAudio-4") # 访问单条样本 sample = dataset["train"][0] print(sample["audio_caption"])

提供机构:
maas
创建时间:
2025-06-22
搜集汇总
数据集介绍
FusionAudio-4 数据集图片
背景与挑战
背景概述
FusionAudio-4是一个音频字幕数据集,包含音频、语音和音乐的字幕描述、音频文件及相关元数据,数据列涵盖id、字幕内容、路径和时间间隔等信息。该数据集采用Apache 2.0许可证,大小为148.11GB,可通过datasets库加载使用,适用于音频内容分析任务。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务