OMIM (Online Mendelian Inheritance in Man)|遗传学数据集|基因研究数据集
收藏
- OMIM项目由维克多·A·麦库西克博士在约翰斯·霍普金斯大学启动,旨在创建一个关于人类孟德尔遗传疾病的综合数据库。
- OMIM数据库首次通过互联网向公众开放,标志着其从纸质版向数字化版本的重大转变。
- OMIM开始与美国国家生物技术信息中心(NCBI)合作,进一步扩展其在线访问和数据整合能力。
- OMIM数据库引入了基因组浏览器,使用户能够更直观地查看基因和相关疾病的遗传信息。
- OMIM数据库进行了重大更新,增加了对基因组学和分子遗传学最新进展的覆盖,提升了数据的质量和深度。
- OMIM继续扩展其数据库,涵盖了更多罕见疾病和复杂性状的遗传信息,同时加强了与其他生物信息学资源的整合。
- 1OMIM.org: Online Mendelian Inheritance in Man (OMIM®), an Online Catalog of Human Genes and Genetic DisordersNational Center for Biotechnology Information · 2007年
- 2The Online Mendelian Inheritance in Man (OMIM) Database: Linking Human Genetics and GenomicsNational Center for Biotechnology Information · 2020年
- 3OMIM: From Genotype to PhenotypeNational Center for Biotechnology Information · 2011年
- 4OMIM: Integrating Genetics and Genomics for Human HealthNational Center for Biotechnology Information · 2015年
- 5OMIM: A Comprehensive, Up-to-Date Database of Human Genes and Genetic DisordersNational Center for Biotechnology Information · 2018年
中国1km分辨率逐月降水量数据集(1901-2023)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2023.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
CatMeows
该数据集包含440个声音样本,由21只属于两个品种(缅因州库恩猫和欧洲短毛猫)的猫在三种不同情境下发出的喵声组成。这些情境包括刷毛、在陌生环境中隔离和等待食物。每个声音文件都遵循特定的命名约定,包含猫的唯一ID、品种、性别、猫主人的唯一ID、录音场次和发声计数。此外,还有一个额外的zip文件,包含被排除的录音(非喵声)和未剪辑的连续发声序列。
huggingface 收录
LIDC-IDRI
LIDC-IDRI 数据集包含来自四位经验丰富的胸部放射科医师的病变注释。 LIDC-IDRI 包含来自 1010 名肺部患者的 1018 份低剂量肺部 CT。
OpenDataLab 收录
红外谱图数据库
收集整理红外谱图实验手册等数据,建成了红外谱图数据库。本数据库收录了常见化合物的红外谱图。主要包括化合物数据和对应的红外谱图数据。其中,原始红外谱图都进行了数字化处理,从而使谱峰检索成为可能。用户可以在数据库中检索指定化合物的谱图,也可以提交谱图/谱峰数据,以检索与之相似的谱图数据,以协助进行谱图鉴定。
国家基础学科公共科学数据中心 收录
PDT Dataset
PDT数据集是由山东计算机科学中心(国家超级计算济南中心)和齐鲁工业大学(山东省科学院)联合开发的无人机目标检测数据集,专门用于检测树木病虫害。该数据集包含高分辨率和低分辨率两种版本,共计5775张图像,涵盖了健康和受病虫害影响的松树图像。数据集的创建过程包括实地采集、数据预处理和人工标注,旨在为无人机在农业中的精准喷洒提供高精度的目标检测支持。PDT数据集的应用领域主要集中在农业无人机技术,旨在提高无人机在植物保护中的目标识别精度,解决传统检测模型在实际应用中的不足。
arXiv 收录