登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
CSQA
CSQA
收藏
OpenXLab
2026-04-18 收录
复杂问答系统
知识图谱推理
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/CSQA
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
包含大约200K对话框,总共1.6M圈。此外,与包含可以从单个元组回答的简单问题的现有大规模QA数据集不同,对话框中的问题需要KG的较大子图。
应用场景:
提供机构:
OpenDataLab
创建时间:
2022-06-23
相关数据集
PELD
情感分析
个性识别
"PELD 是一个基于文本的具有说话者个性特征的情感对话数据集。PELD 中的对话融合了 MELD 和 EmoryNLP 中的情感对话,以及来自 FriendsPersona 的个性特征注释。PELD 中的个性特征是取自 FriendsPersona 中 711 条不同对话中的个性标注。参考标注,一个角色在不同的对话中可能会表现出不同方面的个性。我们只保留六个主要角色的个性特征,因为它
OpenDataLab
2026-07-12 更新
65
0
Pile-HackerNews
技术社区文本挖掘
自然语言处理预训练
Pile-HackerNews数据集是由Hacker News网站获取的数据构建的。 Hacker News是由初创孵化器和投资基金Y Combinator运营的链接聚合网站。 Pile-HackerNews数据集可以用于各种自然语言处理(NLP)任务和研究。
OpenXLab
8
0
MVTec D2S (MVTec Densely Segmented Supermarket)
实例感知语义分割
零售商品分割
MVTec D2S 是工业领域中实例感知语义分割的基准。它包含 21,000 张高分辨率图像,带有所有对象实例的像素标签。这些物品包括来自 60 个类别的杂货和日常用品。该基准的设计使其类似于自动结账、库存或仓库系统的真实设置。训练图像仅包含同质背景上的单个类别的对象,而验证集和测试集则更加复杂和多样化。
OpenXLab
4
0
CoWeSe (Corpus Web Salud Espanol)
生物医学
自然语言处理
CoWeSe 是一个西班牙生物医学语料库,由 4.5GB(约 7.5 亿个令牌)的干净纯文本组成。 CoWeSe 是 2020 年在 3000 个西班牙域名上执行的大规模爬虫的结果。
OpenDataLab
2026-07-12 更新
12
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广