深圳市财政局-卫生健康支出信息|政府财政支出数据集|卫生健康数据集
收藏giovannidemuri__sharegpt-ex50000-seed5_llama8b-er-v573-seed2-hx_256_ngt0.7_tp0.9
该数据集包含了用户与助手之间的对话,其中包含两个字段:用户发言和助手回应,均为字符串类型。训练集大小为38646852字节,共有44096条对话记录。
huggingface 收录
FACED
FACED数据集是由清华大学脑与智能实验室和智能技术与系统国家重点实验室共同创建,包含从123名参与者收集的32通道EEG信号,用于情感计算研究。数据集通过记录参与者观看28个情感诱发视频片段时的EEG信号构建,旨在通过EEG信号分析情感状态。创建过程中,数据经过标准化和统一预处理,设计了四个EEG分类任务。该数据集主要应用于情感识别和脑机接口领域,旨在解决情感计算中的分类问题,提高情感识别的准确性和效率。
arXiv 收录
学生课堂行为数据集 (SCB-dataset3)
学生课堂行为数据集(SCB-dataset3)由成都东软学院创建,包含5686张图像和45578个标签,重点关注六种行为:举手、阅读、写作、使用手机、低头和趴桌。数据集覆盖从幼儿园到大学的不同场景,通过YOLOv5、YOLOv7和YOLOv8算法评估,平均精度达到80.3%。该数据集旨在为学生行为检测研究提供坚实基础,解决教育领域中学生行为数据集的缺乏问题。
arXiv 收录
MedDialog
MedDialog数据集(中文)包含了医生和患者之间的对话(中文)。它有110万个对话和400万个话语。数据还在不断增长,会有更多的对话加入。原始对话来自好大夫网。
github 收录
Global Burden of Disease (GBD)
全球疾病负担数据库(Global Burden of Disease,GBD)是一个全球性的健康数据平台,旨在提供详尽的健康数据资源,涵盖调查、人口普查、生命统计等多方面信息,为全球健康研究提供重要支持。该数据库可通过其官方网站访问,为非商业用户免费提供数据下载、共享、修改及二次开发等服务,但需遵循 IHME 免费非商业用户协议,商业用途需咨询 IHME 条款和条件。GBD 2021 数据及所有 IHME 数据均在此平台提供,是健康数据研究者的重要资源。
ghdx.healthdata.org 收录