rag-datasets/rag-mini-bioasq|生物医学数据集|问答系统数据集
收藏数据集概述
许可证
- 该数据集遵循CC-BY-2.5许可证。
任务类别
- 问答(question-answering)
- 句子相似度(sentence-similarity)
语言
- 英语(en)
标签
- RAG
- DPR
- 信息检索(information-retrieval)
- 问答(question-answering)
- 生物医学(biomedical)
配置
-
配置名称: text-corpus
- 数据文件:
- 分割: passages
- 路径: "data/passages.parquet/*"
- 数据文件:
-
配置名称: question-answer-passages
- 数据文件:
- 分割: test
- 路径: "data/test.parquet/*"
- 数据文件:

Global Burden of Disease Study (GBD)
全球疾病负担研究(GBD)数据集提供了全球范围内疾病、伤害和风险因素的详细统计数据。该数据集包括了各种健康指标,如死亡率、发病率、伤残调整生命年(DALYs)等,涵盖了多个国家和地区。数据集还提供了不同年龄组、性别和时间段的详细分析。
ghdx.healthdata.org 收录
Figshare
Figshare是一个在线数据共享平台,允许研究人员上传和共享各种类型的研究成果,包括数据集、论文、图像、视频等。它旨在促进科学研究的开放性和可重复性。
figshare.com 收录
清博指数系统
清博指数是第三方新媒体数据查询平台。其独有的WCI、BCI、TGI算法公式已被多家央企、500强企业引用。此外,清博可根据客户需求,提供全方位指数模型构建、数据分析以及专项数据报告服务。
杭州数据交易所 收录
中国1km分辨率逐月平均气温数据集(1901-2024)
该数据为中国逐月平均温度数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2024.12。数据格式为NETCDF,即.nc格式。数据单位为0.1 ℃。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
DeepFashion2
DeepFashion2是由香港中文大学创建的大型时尚图像数据集,包含491,000张图像和801,000个服装项目,每个项目都有丰富的标注,如风格、尺度、视角、遮挡、边界框、密集地标和掩码。数据集通过控制尺度、遮挡、缩放和视角的变量来收集,以创建一个具有挑战性的基准。DeepFashion2适用于多种时尚理解任务,包括服装检测、姿态估计、分割和检索,旨在解决时尚图像分析中的实际问题。
arXiv 收录