F-05
收藏基于OFES数据计算台湾以东逐月位涡(1993-2017)
基于1993-2017年间OFES高分辨率模式数据集中的温度和盐度数据计算的台湾以东位势涡度逐月三维分布。所使用OFES数据为开源数据。
国家海洋科学数据中心 收录
哈尔滨市区域产业链点发展评估数据
我司基于哈尔滨市区域产业发展的特征,结合数据的可获得性和有效性,基于不同产业链点的产业规模、龙头效应、资本热度、科技创新、发展效率等多个维度构建哈尔滨市区域产业链点的综合发展效能评估体系,并完成数据收集、数据清洗、特征衍生、模型构建、模型验证全过程,形成涵盖哈尔滨市主要产业链下核心链点的区域产业链点发展评分,能有效帮助金融机构在制定产业相关信贷政策以及确定特定产业预授信额度时,更准确全面地评价区域产业的发展效能和动态变化,辅助金融机构更好做好区域产业金融服务。区域产业链点发展指数 = ∑ Si * Xi ,其中Si是指标相应的权重系数,Xi是评价指标,i=1,2,3,……,21,21个指标包括“区域产业链点在营企业数量”“区域产业链点近1年新注册企业数量”等,指标经归一化处理后参与计算。模型结合专家经验和机器学习算法得出,专家主要基于行业实践、政策导向和国际贸易特点,帮助筛选关键指标并初步设定权重范围,然后通过主成分分析和随机森林算法进一步筛选指标并对初始权重进行优化。
浙江省数据知识产权登记平台 收录
OpenML-CC18
我们提倡使用经过整理的、全面的机器学习数据集基准测试套件,以标准化的基于 OpenML 的接口和用 Python、Java 和 R 编写的互补软件工具包为后盾。我们展示了如何使用标准化的基于 OpenML 的基准测试套件轻松执行全面的基准测试研究以及用 Python、Java 和 R 编写的互补软件工具包。 OpenML 基准测试套件的主要显着特点是 (i) 通过标准化数据格式、API 和现有客户端库易于使用; (ii) 关于套件内容的机器可读元信息; (iii) 在线共享结果,实现大规模比较。作为第一个这样的套件,我们提出了 OpenML-CC18,这是一个机器学习基准套件,包含 72 个分类数据集,从 OpenML 上的数千个数据集中精心策划。纳入标准是: * 密集数据集独立观察的分类任务 * 类数 >= 2,每个类至少有 20 个观察和少数类与多数类的比例必须超过 5% * 500 <= 观察数 <= 100000 * one-hot-encoding 后的特征数量 < 5000 * 没有人工数据集 * 没有更大数据集的子集,也没有其他数据集的二值化 * 没有可以通过使用单个特征或使用简单的决策树来完全预测的数据集* 来源或参考可用 如果您使用此基准测试套件,请引用:Bernd Bischl、Giuseppe Casalicchio、Matthias Feurer、Frank Hutter、Michel Lang、Rafael G. Mantovani、Jan N. van Rijn 和 Joaquin Vanschoren。 “OpenML 基准测试套件”arXiv:1708.03731v2 [stats.ML] (2019)。 @article{oml-benchmarking-suites, title={OpenML Benchmarking Suites}, author={Bernd Bischl and Giuseppe Casalicchio and Matthias Feurer and Frank Hutter and Michel Lang and Rafael G. Mantovani and Jan N. van Rijn and Joaquin Vanschoren},年={2019},日记={arXiv:1708.03731v2 [stat.ML]} }
OpenDataLab 收录
EdNet
displayName: EdNet license: - CC BY-NC 4.0 paperUrl: https://arxiv.org/pdf/1912.03072v3.pdf publishDate: "2019" publishUrl: https://github.com/riiid/ednet publisher: - University of Michigan - Yale University - University of California, Berkeley - Riiid AI Research tags: - Student Activities taskTypes: - Knowledge Tracing --- # 数据集介绍 ## 简介 圣诞老人收集的各种学生活动的大规模分层数据集,一个配备人工智能辅导系统的多平台自学解决方案。 EdNet 包含 2 年多来收集的 784,309 名学生的 131,441,538 次互动,这是迄今为止向公众发布的 ITS 数据集中最大的。资料来源:EdNet:教育中的大规模分层数据集 ## 引文 ``` @inproceedings{choi2020ednet, title={Ednet: A large-scale hierarchical dataset in education}, author={Choi, Youngduck and Lee, Youngnam and Shin, Dongmin and Cho, Junghyun and Park, Seoyon and Lee, Seewoo and Baek, Jineon and Bae, Chan and Kim, Byungsoo and Heo, Jaewe}, booktitle={International Conference on Artificial Intelligence in Education}, pages={69--73}, year={2020}, organization={Springer} } ``` ## Download dataset :modelscope-code[]{type="git"}
魔搭社区 收录
World Development Indicators (WDI)
世界发展指标(World Development Indicators, WDI)是由世界银行发布的一个综合数据集,涵盖了全球200多个国家和地区的经济、社会和环境指标。数据集包括人口统计、教育、健康、经济、环境等多个领域的指标,旨在提供全球发展状况的全面视图。
databank.worldbank.org 收录
