有没有相关的论文或文献参考?
这个数据集是基于什么背景创建的?
数据集的作者是谁?
能帮我联系到这个数据集的作者吗?
这个数据集如何下载?
UCSD26/medical_dialog
MedDialog数据集包含中英文两种语言的医患对话数据。中文数据集包含110万条对话和400万条话语,数据来源于haodf.com。英文数据集包含26万条对话,数据来源于healthcaremagic.com和icliniq.com。数据集的结构包括原始数据和经过处理的数据,原始数据包含对话ID、URL、患者病情描述和对话内容,处理后的数据则包括描述和对话话语。数据集的主要任务是封闭领域的问答(Closed domain QA)。
hugging_face 收录
CBIS-DDSM
该数据集用于训练乳腺癌分类器或分割模型,包含3103张乳腺X光片,其中465张有多个异常。数据集分为训练集和测试集,还包括3568张裁剪的乳腺X光片和对应的掩码。
github 收录
中国气象数据
本数据集包含了中国2023年1月至11月的气象数据,包括日照时间、降雨量、温度、风速等关键数据。通过这些数据,可以深入了解气象现象对不同地区的影响,并通过可视化工具揭示中国的气温分布、降水情况、风速趋势等。
github 收录
Air Quality Data from U.S. Embassies
该存储库包含从美国驻外使领馆收集的历史空气质量数据。
github 收录
HazyDet
HazyDet是由解放军工程大学等机构创建的一个大规模数据集,专门用于雾霾场景下的无人机视角物体检测。该数据集包含383,000个真实世界实例,收集自自然雾霾环境和正常场景中人工添加的雾霾效果,以模拟恶劣天气条件。数据集的创建过程结合了深度估计和大气散射模型,确保了数据的真实性和多样性。HazyDet主要应用于无人机在恶劣天气条件下的物体检测,旨在提高无人机在复杂环境中的感知能力。
arXiv 收录