CoVCSD - Covid-19 Countries Statistical Dataset|COVID-19数据集|统计数据分析数据集
收藏Salinas
Salinas数据集是一个高光谱遥感图像数据集,包含16个波段,覆盖了加利福尼亚州Salinas山谷的农业区域。该数据集主要用于高光谱图像分类和土地覆盖分析。
www.ehu.eus 收录
中国近海台风路径集合数据集(1945-2024)
1945-2024年度,中国近海台风路径数据集,包含每个台风的真实路径信息、台风强度、气压、中心风速、移动速度、移动方向。时间为北京时间。
国家海洋科学数据中心 收录
哈尔滨市区域产业链点发展评估数据
我司基于哈尔滨市区域产业发展的特征,结合数据的可获得性和有效性,基于不同产业链点的产业规模、龙头效应、资本热度、科技创新、发展效率等多个维度构建哈尔滨市区域产业链点的综合发展效能评估体系,并完成数据收集、数据清洗、特征衍生、模型构建、模型验证全过程,形成涵盖哈尔滨市主要产业链下核心链点的区域产业链点发展评分,能有效帮助金融机构在制定产业相关信贷政策以及确定特定产业预授信额度时,更准确全面地评价区域产业的发展效能和动态变化,辅助金融机构更好做好区域产业金融服务。区域产业链点发展指数 = ∑ Si * Xi ,其中Si是指标相应的权重系数,Xi是评价指标,i=1,2,3,……,21,21个指标包括“区域产业链点在营企业数量”“区域产业链点近1年新注册企业数量”等,指标经归一化处理后参与计算。模型结合专家经验和机器学习算法得出,专家主要基于行业实践、政策导向和国际贸易特点,帮助筛选关键指标并初步设定权重范围,然后通过主成分分析和随机森林算法进一步筛选指标并对初始权重进行优化。
浙江省数据知识产权登记平台 收录
China Kadoorie Biobank (CKB)
China Kadoorie Biobank(CKB)是一项大规模的前瞻性队列研究数据库,旨在通过长期跟踪调查收集中国人群的健康相关信息,包括生活方式、环境暴露、生物样本以及疾病发生发展情况,为慢性病的病因研究和防控策略制定提供科学依据。
www.ckbiobank.org 收录
Traditional-Chinese-Medicine-Dataset-SFT
该数据集是一个高质量的中医数据集,主要由非网络来源的内部数据构成,包含约1GB的中医各个领域临床案例、名家典籍、医学百科、名词解释等优质内容。数据集99%为简体中文内容,质量优异,信息密度可观。数据集适用于预训练或继续预训练用途,未来将继续发布针对SFT/IFT的多轮对话和问答数据集。数据集可以独立使用,但建议先使用配套的预训练数据集对模型进行继续预训练后,再使用该数据集进行进一步的指令微调。数据集还包含一定比例的中文常识、中文多轮对话数据以及古文/文言文<->现代文翻译数据,以避免灾难性遗忘并加强模型表现。
huggingface 收录
