有没有相关的论文或文献参考?
这个数据集是基于什么背景创建的?
数据集的作者是谁?
能帮我联系到这个数据集的作者吗?
这个数据集如何下载?
giovannidemuri__sharegpt-ex50000-seed5_llama8b-er-v573-seed2-hx_256_ngt0.7_tp0.9
该数据集包含了用户与助手之间的对话,其中包含两个字段:用户发言和助手回应,均为字符串类型。训练集大小为38646852字节,共有44096条对话记录。
huggingface 收录
中国近海台风路径集合数据集(1945-2024)
1945-2024年度,中国近海台风路径数据集,包含每个台风的真实路径信息、台风强度、气压、中心风速、移动速度、移动方向。 数据源为获取温州台风网(http://www.wztf121.com/)的真实观测路径数据,经过处理整合后形成文件,如使用csv文件需使用文本编辑器打开浏览,否则会出现乱码,如要使用excel查看数据,请使用xlsx的格式。
国家海洋科学数据中心 收录
Photovoltaic power plant data
包括经纬度、电源板模型、NWP等信息。
github 收录
Multi-view Datasets
该数据集包含多个多视角基准数据集,用于聚类或分类任务。数据集包括AwA、COIL100、MNIST2、NUSWIDEOBJ、PIE和YoutubeFaces,每个数据集都有详细的描述和多视角特征。
github 收录
ADE20K
ADE20K 数据集包含 Scene Parsing Benchmark 场景数据和部分分割数据。图像和注释:每个文件夹包含按场景类别分类的图像,对象和部分分割分别存储在两个不同的 png 文件中。所有对象和零件实例均已单独注释。
OpenDataLab 收录