登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
yemeni-arabic-conversational-speech-corpus
yemeni-arabic-conversational-speech-corpus
收藏
OpenXLab
2026-04-18 收录
方言语音识别
对话数据
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/yemeni-arabic-conversational-speech-corpus
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
这个开源数据集包括10.42个小时的转录也门阿拉伯语对话演讲,其中包含五对说话者之间的30次对话。
应用场景:
提供机构:
OpenDataLab
创建时间:
2023-10-11
相关数据集
WiderPerson
密集行人检测
人脸遮挡识别
WiderPerson总共包含13,382个带有399,786注释的图像,即每个图像29.87个注释,这意味着该数据集包含具有各种遮挡的密集行人。因此,由于场景和遮挡的差异很大,因此建议的数据集中的行人极具挑战性,这适合于评估野外的行人检测器。
OpenXLab
10
0
CQR (Contextual Query Rewrite)
自然语言处理
对话系统
我们提出了上下文查询重写 (CQR) 数据集,用于多领域面向任务的口语对话系统,它是斯坦福对话语料库的扩展 (Eric et al., 2017a)。虽然以前的方法通过学习候选转换来解决不同模式的问题(Naik 等人,2018),但我们将参考解析任务建模为用户查询重构任务,其中对话状态被序列化为自然语言查询,可以由下游口语理解系统执行。
OpenXLab
4
0
Booster Dataset
立体视觉匹配
镜面与透明表面处理
我们提出了一种新颖的高分辨率且具有挑战性的立体数据集,将室内场景与密集且准确的地面真相差异进行注释。我们的数据集特有的是几个镜面和透明表面的存在,即最先进的立体声网络故障的主要原因。我们的采集管道利用了一种新颖的深时空立体声框架,该框架可以轻松,准确地以亚像素精度进行标记。我们总共发布了在64个不同场景中收集的419个样本,并用密集的地面真相差异进行注释。每个样本包括高分辨率对 (12 mpx)
OpenXLab
4
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
locailabs/ultrachat_nemotron_120b
对话数据
大语言模型指令微调
--- language: - en license: cc-by-4.0 task_categories: - text-generation tags: - ultrachat - synthetic - nemotron --- # UltraChat Responses (Nemotron-3-Super-120B) Synthetic general-purpos
Hugging Face
2026-04-12 更新
4
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广