Braunkohle - Primärenergieverbrauch in Deutschland bis 2023|能源消费数据集|褐煤数据集
收藏giovannidemuri__sharegpt-ex50000-seed5_llama8b-er-v573-seed2-hx_256_ngt0.7_tp0.9
该数据集包含了用户与助手之间的对话,其中包含两个字段:用户发言和助手回应,均为字符串类型。训练集大小为38646852字节,共有44096条对话记录。
huggingface 收录
animelist-dataset
一个基于JSON的动漫数据集,包含了最重要的元数据以及与其他多个动漫网站(如MAL、ANIDB、ANILIST、KITSU等)的交叉引用。数据集每周更新,涵盖了从10K到100K条记录的规模,主要语言为英语和日语,标签为'anime'。
huggingface 收录
Qilin
Qilin数据集是由清华大学和小红书公司合作创建的多模态信息检索数据集。该数据集包含来自小红书平台上超过3000万月活跃用户的APP级信息发现会话,涵盖了搜索、DQA(深度查询回答)和推荐等多种场景。Qilin特色在于收集了丰富的APP级上下文信号和真实用户反馈,有助于深入分析用户状态转换、回访和查询重构等行为,以建模用户满意度和长期留存。数据集中的用户会话包含文本和图像内容,适用于多种检索场景下的复杂查询意图理解和会话级跨模态匹配任务。
arXiv 收录
NOAA Climate Data Online
NOAA Climate Data Online(CDO)是一个提供全球气候数据的平台,包括历史天气数据、气候预测、气候指数等。数据涵盖温度、降水、风速、湿度等多种气象参数,适用于气候研究、农业规划、灾害预警等多个领域。
www.ncdc.noaa.gov 收录
Google Scholar
Google Scholar是一个学术搜索引擎,旨在检索学术文献、论文、书籍、摘要和文章等。它涵盖了广泛的学科领域,包括自然科学、社会科学、艺术和人文学科。用户可以通过关键词搜索、作者姓名、出版物名称等方式查找相关学术资源。
scholar.google.com 收录