mapping-mesothelioma.ipynb|间皮瘤数据集|数据可视化数据集
收藏PRBench
PRBench是一个大规模专家标注的专业领域高风险推理基准测试数据集,当前版本覆盖法律和金融领域。包含1,100个专家编写的跨金融和法律领域的对话,19,356个专家策划的评估标准(每个任务10-30条),覆盖114个国家、47个美国司法管辖区和25个专业主题,并包含最具挑战性任务的硬子集(Finance-300, Legal-250)。
github 收录
ICLR Peer Review and Rebuttal Process Dataset
该数据集包含从ICLR 2024和2025年收集的同行评审和反驳过程数据,数据来自OpenReview平台,包括评审者ID、初始评分和反驳后评分。评审者评分变化被追踪,使用追踪分数指标来评估评审者连续性,分数≤1表示有效使用,≥2需双重检查。数据许可证为CC BY 4.0。
github 收录
基于OFES数据计算台湾以东逐月位涡(1993-2017)
基于1993-2017年间OFES高分辨率模式数据集中的温度和盐度数据计算的台湾以东位势涡度逐月三维分布。所使用OFES数据为开源数据。
国家海洋科学数据中心 收录
MVIP
MVIP是一个面向应用的多视角和多模态工业零件识别数据集,由弗劳恩霍夫IPK研究所创建。该数据集包含了校准过的RGBD多视角图像以及对象的物理属性、自然语言描述和超类别等信息。数据集共包含约570,000张图像,分为训练集、验证集和测试集,适用于工业零件识别相关的研究,旨在解决小样本学习、视觉相似零件识别等问题。
arXiv 收录
DeepLesion
美国国立卫生研究院临床中心公开了一个大规模的 CT 图像数据集,以帮助科学界提高病变检测的准确性。虽然大多数公开可用的医学图像数据集只有不到一千个病灶,但这个名为 DeepLesion 的数据集在 CT 图像上识别出超过 32,000 个带注释的病灶 (220GB)。 DeepLesion,一个数据集,包含 32,120 个 CT 切片中的 32,735 个病灶,来自 4,427 名独特患者的 10,594 项研究。该数据集中有多种病变类型,例如肺结节、肝脏肿瘤、淋巴结肿大等。它具有用于各种医学图像应用的潜力
OpenDataLab 收录
