遇见数据集

maomlab/MolData

收藏
Hugging Face2025-05-28 更新2025-04-26 收录
官方服务:

资源简介:

MolData是一个全面的基于疾病和靶点的数据集,从PubChem收集而成,包含了大约1.7亿个药物筛选结果,涉及140万个独特的分子和600个生物测定。该数据集是为了加速分子机器学习,以便更好地进行药物发现。

MolData is a comprehensive disease and target-based dataset collected from PubChem, containing approximately 170 million drug screening results from 1.4 million unique molecules and 600 assays, aiming to accelerate molecular machine learning for better drug discovery.

提供机构:
maomlab
搜集汇总
数据集介绍
maomlab/MolData 数据集图片
背景与挑战
背景概述
MolData是一个综合性分子数据集,从PubChem收集了140万个独特分子,专注于疾病和靶点相关的生物活性数据,用于机器学习中的表格分类任务。数据集规模庞大,包含约1.683亿行数据,已进行预处理(如SMILES标准化)并划分为训练、验证和测试集,支持药物发现和生物测定研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务