登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Jazz 48Khz Stereo WAV
Jazz 48Khz Stereo WAV
收藏
kaggle
2023-04-21 更新
2024-03-11 收录
音频生成
WaveGAN
数据链接:
https://www.kaggle.com/datasets/clementdelteil/jazz-48khz-stereo-wav
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
35 minutes of jazz for audio generation using a WaveGAN
35分钟的爵士乐数据集,用于基于WaveGAN的音频生成任务
应用场景:
创建时间:
2023-04-21
相关数据集
AudioCoT
多模态学习
音频生成
AudioCoT是一个大型多模态数据集,包含结构化的推理注释,建立了视觉内容、文本描述和声音合成之间的联系。该数据集用于训练ThinkSound模型,该模型能够逐步、交互式地生成和编辑音频。数据集由视频-音频对和音频-文本对组成,涵盖了现实世界中的各种音频视觉事件,并通过多阶段处理流程和自动化的推理生成流程进行构建。
arXiv
2025-06-27 更新
157
0
CRPO
音频生成
偏好优化
CRPO数据集是由新加坡科技设计大学和NVIDIA的研究团队通过CLAP-Ranked Preference Optimization (CRPO)框架创建的音频偏好数据集。该数据集旨在解决文本到音频生成模型在偏好对齐方面的挑战,通过迭代生成和优化偏好数据来提升模型性能。数据集的内容包括通过CLAP模型排名的音频样本,用于构建偏好对并进行优化。CRPO数据集的应用领域主要集中在文本到音频生成模型的
arXiv
2024-12-31 更新
73
0
slseanwu/clotho-chatgpt-mixup-50K
音频生成
语言模型增强
该数据集是对应于论文《Improving Audio Captioning Models with Fine-grained Audio Features, Text Embedding Supervision, and LLM Mix-up Augmentation》第2.3节的产物。数据集的上游数据来源于Clotho V2数据集的开发集,用于预训练音频字幕生成模型。数据文件包含ChatGPT输
Hugging Face
2024-01-06 更新
24
0
declare-lab/audio-alpaca
音频生成
用户偏好分析
Audio-alpaca是一个成对偏好数据集,包含约15k个(prompt, chosen, rejected)三元组,其中给定一个文本提示,chosen是首选的生成音频,rejected是不受欢迎的音频。
Hugging Face
2024-07-18 更新
90
0
WaveFake: A data set to facilitate audio DeepFake detection
deepfake检测
音频生成
The main purpose of this data set is to facilitate research into audio DeepFakes. We hope that this work helps in finding new detection methods to prevent such attempts. These generated media files ha
Mendeley Data
2024-03-27 更新
25
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广