The Open Quantum Materials Database (OQMD)|材料科学数据集|量子计算数据集
收藏
- The Open Quantum Materials Database (OQMD) 首次发表,标志着量子材料数据库领域的开源创新。
- OQMD 首次应用于材料科学研究,为研究人员提供了大规模的量子材料数据集。
- OQMD 数据集扩展至包含超过300,000种材料的计算数据,显著提升了其在材料科学中的应用价值。
- OQMD 引入机器学习算法,增强了数据分析和预测能力,进一步推动了材料科学的创新研究。
- OQMD 与多个国际研究机构合作,实现了数据的全球共享和协同研究,提升了其国际影响力。
- 1The Open Quantum Materials Database (OQMD): A community effort to systematize DFT-computed properties of materialsNorthwestern University · 2015年
- 2Machine learning for materials scientists: The materials genome initiative and the Open Quantum Materials DatabaseNorthwestern University · 2016年
- 3High-throughput computational screening of new materials for energy applications using the Open Quantum Materials DatabaseNorthwestern University · 2017年
- 4Predicting the thermodynamic stability of materials: The Open Quantum Materials Database (OQMD) approachNorthwestern University · 2018年
- 5The Open Quantum Materials Database (OQMD) and its application to machine learningNorthwestern University · 2019年
UIEB, U45, LSUI
本仓库提供了水下图像增强方法和数据集的实现,包括UIEB、U45和LSUI等数据集,用于支持水下图像增强的研究和开发。
github 收录
RAVDESS
情感语音和歌曲 (RAVDESS) 的Ryerson视听数据库包含7,356个文件 (总大小: 24.8 GB)。该数据库包含24位专业演员 (12位女性,12位男性),以中性的北美口音发声两个词汇匹配的陈述。言语包括平静、快乐、悲伤、愤怒、恐惧、惊讶和厌恶的表情,歌曲则包含平静、快乐、悲伤、愤怒和恐惧的情绪。每个表达都是在两个情绪强度水平 (正常,强烈) 下产生的,另外还有一个中性表达。所有条件都有三种模态格式: 纯音频 (16位,48kHz .wav),音频-视频 (720p H.264,AAC 48kHz,.mp4) 和仅视频 (无声音)。注意,Actor_18没有歌曲文件。
OpenDataLab 收录
Breast Cancer Dataset
该项目专注于清理和转换一个乳腺癌数据集,该数据集最初由卢布尔雅那大学医学中心肿瘤研究所获得。目标是通过应用各种数据转换技术(如分类、编码和二值化)来创建一个可以由数据科学团队用于未来分析的精炼数据集。
github 收录
ChinaTravel
ChinaTravel是由南京大学国家重点实验室开发的一个真实世界基准数据集,专门用于评估语言代理在中国旅行规划中的应用。该数据集涵盖了中国10个最受欢迎城市的旅行信息,包括720个航班和5770趟列车,以及3413个景点、4655家餐厅和4124家酒店的详细信息。数据集通过问卷调查收集用户需求,并设计了一个可扩展的领域特定语言来支持自动评估。ChinaTravel旨在解决复杂的真实世界旅行规划问题,特别是在多兴趣点行程安排和用户偏好满足方面,为语言代理在旅行规划中的应用提供了重要的测试平台。
arXiv 收录
UniMed
UniMed是一个大规模、开源的多模态医学数据集,由穆罕默德·本·扎耶德人工智能大学等机构创建,包含超过530万张图像-文本对,涵盖六种不同的医学成像模态:X射线、CT、MRI、超声、病理和眼底。数据集通过利用大型语言模型(LLMs)将特定模态的分类数据集转换为图像-文本格式,并结合现有的医学图像-文本数据,实现了可扩展的视觉-语言模型(VLM)预训练。UniMed旨在解决医学领域中公开可用的大规模图像-文本数据稀缺的问题,适用于多种医学成像任务,如零样本分类和跨模态泛化。
arXiv 收录