登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
WikiQA (Open-Domain Q&A)
WikiQA (Open-Domain Q&A)
收藏
kaggle
2022-11-20 更新
2024-05-06 收录
问答系统
自然语言处理
数据链接:
https://www.kaggle.com/datasets/thedevastator/wikiquestionanswer-a-dataset-for-open-domain-que
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Discovering New Knowledge through Question and Sentence Pairs
基于问题与语句对的新知识发现
应用场景:
创建时间:
2022-11-20
相关数据集
ChemCoTBench
化学信息学
自然语言处理
ChemCoTBench是一个用于评估大型语言模型(LLM)在化学应用中的推理能力的基准数据集。它通过将复杂的化学任务分解为一系列可验证的模块化化学操作来评估LLM的推理能力。数据集包含1495个样本,涵盖了22个化学任务,包括分子理解、编辑、优化和反应预测。该数据集的创建旨在解决现有化学基准数据集缺乏推理和应用导向任务的局限性。
arXiv
2025-05-27 更新
60
0
arthurmluz/GPTextSum_data-temario_results
文本摘要
自然语言处理
--- dataset_info: features: - name: id dtype: int64 - name: text dtype: string - name: summary dtype: string - name: gen_summary dtype: string - name: rouge struct:
Hugging Face
2023-11-15 更新
14
0
rebnej/coco-train-git-large-5best-alpaca
图像处理
自然语言处理
该数据集包含图像ID、输入序列、输出字符串和指令字符串等特征。数据集仅包含训练集,共有566,747个示例,总大小为274,596,574字节。数据集的下载大小为25,652,085字节。
Hugging Face
2024-07-18 更新
9
0
surrey-nlp/PLOD-CW
缩写词识别
自然语言处理
PLOD数据集是一个用于缩写检测的英文数据集,主要支持自然语言处理中的缩写检测任务。该数据集来源于PLOS期刊,包含了文本中的缩写及其长形式的标注。数据集结构包括tokens、pos_tags和ner_tags三个字段,分别表示文本中的词、词性标注和命名实体标注。数据集分为训练集、验证集和测试集,并提供了过滤和未过滤两个版本。该数据集的使用场景包括科学领域的文档理解,并且已经在AAAI 2022的
Hugging Face
2024-03-04 更新
18
0
rmsdud/chat
聊天机器人
自然语言处理
该数据集包含对话数据,主要特征为context(上下文)和response(响应),均为字符串类型。数据集包含一个训练集,共有23263个样本,总大小为3753161字节。数据集的下载大小为1554612字节。
Hugging Face
2024-12-05 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广