登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
BelleGroup-train_2M_CN
BelleGroup-train_2M_CN
收藏
OpenXLab
2026-04-18 收录
指令微调
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/BelleGroup-train_2M_CN
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
包含由BELLE项目生成的约200万个中文指令数据。
应用场景:
提供机构:
OpenDataLab
创建时间:
2023-04-28
相关数据集
Clothing Attributes Dataset
服装属性识别
细粒度分析
我们引入服装属性数据集,以促进学习对象视觉属性的研究。该数据集包含1856个图像,具有26个地面真相服装属性,例如 “长袖”,“有衣领” 和 “条纹图案”。标签是使用Amazon Mechanical Turk收集的。
OpenXLab
8
0
CQR (Contextual Query Rewrite)
自然语言处理
对话系统
我们提出了上下文查询重写 (CQR) 数据集,用于多领域面向任务的口语对话系统,它是斯坦福对话语料库的扩展 (Eric et al., 2017a)。虽然以前的方法通过学习候选转换来解决不同模式的问题(Naik 等人,2018),但我们将参考解析任务建模为用户查询重构任务,其中对话状态被序列化为自然语言查询,可以由下游口语理解系统执行。
OpenXLab
4
0
Booster Dataset
立体视觉匹配
镜面与透明表面处理
我们提出了一种新颖的高分辨率且具有挑战性的立体数据集,将室内场景与密集且准确的地面真相差异进行注释。我们的数据集特有的是几个镜面和透明表面的存在,即最先进的立体声网络故障的主要原因。我们的采集管道利用了一种新颖的深时空立体声框架,该框架可以轻松,准确地以亚像素精度进行标记。我们总共发布了在64个不同场景中收集的419个样本,并用密集的地面真相差异进行注释。每个样本包括高分辨率对 (12 mpx)
OpenXLab
4
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
tabular-benchmark
机器学习基准
数据建模
This dataset is a curation of various datasets from openML and is curated to benchmark performance of various machine learning algorithms.
OpenXLab
4
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广