高新技术企业审核登记信息|高新技术企业数据集|审核登记数据集
收藏中国劳动力动态调查
“中国劳动力动态调查” (China Labor-force Dynamics Survey,简称 CLDS)是“985”三期“中山大学社会科学特色数据库建设”专项内容,CLDS的目的是通过对中国城乡以村/居为追踪范围的家庭、劳动力个体开展每两年一次的动态追踪调查,系统地监测村/居社区的社会结构和家庭、劳动力个体的变化与相互影响,建立劳动力、家庭和社区三个层次上的追踪数据库,从而为进行实证导向的高质量的理论研究和政策研究提供基础数据。
中国学术调查数据资料库 收录
中国农村教育发展报告
该数据集包含了中国农村教育发展的相关数据,涵盖了教育资源分布、教育质量、学生表现等多个方面的信息。
www.moe.gov.cn 收录
MMOral
MMOral是一个针对全景X光片解读的大规模多模态指令数据集和基准。它包括20,563张带有1.3百万条指令跟随实例的注释图像,涵盖了多种任务类型,如属性提取、报告生成、视觉问答和基于图像的对话。此外,我们还提出了MMOral-Bench,这是一个涵盖牙科五个关键诊断维度的综合评估套件。我们评估了64个LVLMs在MMOral-Bench上的表现,发现即使是表现最好的模型GPT-4o,也只能达到41.45%的准确率,这揭示了当前模型在这一领域的显著局限性。为了促进该特定领域的发展,我们还提出了OralGPT,它使用我们精心策划的MMOral指令数据集对Qwen2.5-VL-7B进行监督微调。值得注意的是,一个SFT周期就为LVLMs带来了显著的性能提升,例如,OralGPT表现出24.73%的改进。MMOral和OralGPT都具有作为智能牙科关键基础的巨大潜力,并使牙科领域中的多模态AI系统更具临床意义。数据集、模型、基准和评估套件可在上述网址获取。
arXiv 收录
中国陆地实际蒸散发数据集(1982-2024)
本数据集为基于蒸散发互补方法研制的中国陆地蒸散发数据产品v2.0。输入数据包括CMFD v2的向下短波辐射、向下长波辐射、气温、湿度、风速、气压,GLASS反照率、发射率等,以及ERA5-Land地表温度等。本数据集时间跨度为1982年-2024年,空间范围为中国陆地。本数据集可为研究长时间尺度水循环和气候变化提供基础。陆地实际蒸散发 (Ea),单位: mm/month。 时间分辨率为逐月;空间分辨率为0.1°。数据类型:NetCDF;本数据仅为陆地实际蒸散发,不含水面。
国家青藏高原科学数据中心 收录
IMDB Movie Reviews Dataset
该数据集包含25,000条正面和25,000条负面电影评论,用于训练和测试情感分析模型。评论以CSV文件格式提供,包含review文本和sentiment标签(正面/负面)。
github 收录
