登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
BirdCall No Background N-R
BirdCall No Background N-R
收藏
kaggle
2020-07-14 更新
2024-03-07 收录
叫声识别
音频处理
数据链接:
https://www.kaggle.com/datasets/luisblanche/birdcall-singing-3
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Cornell Birdcall recognition splitted by amplitude
按振幅拆分的康奈尔鸟类鸣叫声识别数据集
应用场景:
创建时间:
2020-07-14
相关数据集
muchomusic
音频处理
文本指令交互
该数据集用于处理音频和文本指令的交互任务。它包含一个测试集,测试集中的每个样本包括一段音频(context)、一个指令(instruction)、多个选择项(choices)和一个正确答案(answer)。
Hugging Face
2024-10-16 更新
16
0
audio_pretrain_10m-facodec
音频处理
面部编码
该数据集包含多个特征,包括文本转录(transcript)、音频数据(audio)、多个面部编码特征(facodec_X)以及说话者嵌入(spk_embs)。数据集被划分为多个名为'vm_X'的分片,每个分片包含7633个样本。每个分片的具体文件路径在配置部分提供。数据集的总大小和下载大小分别为107,457,894,456.52803字节和68,284,553,545字节。
Hugging Face
2024-12-07 更新
10
0
tii-audio/meld_eval
对话系统
音频处理
该数据集包含多个特征,包括提示(prompt)、真实值(gt)、来源(source)、任务(task)、ID(id)、音频(audio)、音频样本数(num_audio_samples)、采样率(sampling_rate)、对话(conversation)和语言(language)。数据集被划分为一个测试集,包含3718个样本,总大小为1259542字节。数据集的下载大小为75147字节。
Hugging Face
2024-12-11 更新
7
0
Piyush2512/crema_audio
情感分析
音频处理
--- dataset_info: features: - name: anger dtype: 'null' - name: sad dtype: 'null' - name: fear dtype: 'null' - name: happy dtype: 'null' - name: disgusted dtype: 'null'
Hugging Face
2024-04-11 更新
11
0
resample_after_augmentation_dataset
音频处理
语音识别
The audio files of 2 Quran reciters augmented using TimeStretch effect.
kaggle
2023-12-19 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广