Oenococcus oeni|微生物学数据集|生物信息学数据集
收藏CCDC 2152220: Experimental Crystal Structure Determination
Related Article: Yali Zhou, Gary S. Nichol, Jennifer A. Garden|2022|Eur.J.Inorg.Chem.|2022||doi:10.1002/ejic.202200134
DataCite Commons 收录
Traditional-Chinese-Medicine-Dataset-SFT
该数据集是一个高质量的中医数据集,主要由非网络来源的内部数据构成,包含约1GB的中医各个领域临床案例、名家典籍、医学百科、名词解释等优质内容。数据集99%为简体中文内容,质量优异,信息密度可观。数据集适用于预训练或继续预训练用途,未来将继续发布针对SFT/IFT的多轮对话和问答数据集。数据集可以独立使用,但建议先使用配套的预训练数据集对模型进行继续预训练后,再使用该数据集进行进一步的指令微调。数据集还包含一定比例的中文常识、中文多轮对话数据以及古文/文言文<->现代文翻译数据,以避免灾难性遗忘并加强模型表现。
huggingface 收录
BBGRE
The Brain & Body Genetic Resource Exchange (BBGRE) provides a resource for investigating the genetic basis of neurodisability. It combines phenotype information from patients with neurodevelopmental and behavioural problems with clinical genetic data, and displays this information on the human genome map.
国家生物信息中心 收录
LUNA16
LUNA16(肺结节分析)数据集是用于肺分割的数据集。它由 1,186 个肺结节组成,在 888 次 CT 扫描中进行了注释。
OpenDataLab 收录
ADE20K
ADE20K 数据集包含 Scene Parsing Benchmark 场景数据和部分分割数据。图像和注释:每个文件夹包含按场景类别分类的图像,对象和部分分割分别存储在两个不同的 png 文件中。所有对象和零件实例均已单独注释。
OpenDataLab 收录