A15_29331.jpg
收藏Wind Turbine Data
该数据集包含风力涡轮机的运行数据,包括风速、风向、发电量等参数。数据记录了多个风力涡轮机在不同时间点的运行状态,适用于风能研究和风力发电系统的优化分析。
www.kaggle.com 收录
库帕思金融大模型评测数据集(2024版)
金融大模型评测数据集(2024版),对标《金融大模型应用测评指南》(T/SAIAS 019—2024),涵盖金融行业核心领域,数据来自金融机构行业实践,是金融领域大模型应用成效评测的重要抓手。 评测数据集比照最高水平、最好标准,具有规模大、结构优、价值对齐等特点,符合金融领域对知识鲜活度、多样性和高密度的整体要求。 聚焦“模型基础能力”,围绕计算能力、逻辑推理等6个维度,设计评测数据22000余句对。 聚焦“金融安全与价值对齐能力”,围绕信息内容、社会秩序等13个维度,设计评测数据2000余句对。 聚焦“金融风险控制能力”,围绕合规、市场、操作等5类金融风险,设计评测数据1000余句对。 聚焦“金融业务辅助拓展能力”,围绕舆情分析、智能投研等3项业务场景,设计评测数据12000余句对。 聚焦“金融专业认知能力”,围绕金融专业知识、IPO图表等7种知识类型,设计评测数据7000余句对。 金融大模型评测数据集定期更新、动态迭代,1250条样例集已在Open Data Lab完成开源。
OpenDataLab 收录
CE-CSL
CE-CSL数据集是由哈尔滨工程大学智能科学与工程学院创建的中文连续手语数据集,旨在解决现有数据集在复杂环境下的局限性。该数据集包含5,988个从日常生活场景中收集的连续手语视频片段,涵盖超过70种不同的复杂背景,确保了数据集的代表性和泛化能力。数据集的创建过程严格遵循实际应用导向,通过收集大量真实场景下的手语视频材料,覆盖了广泛的情境变化和环境复杂性。CE-CSL数据集主要应用于连续手语识别领域,旨在提高手语识别技术在复杂环境中的准确性和效率,促进聋人与听人社区之间的无障碍沟通。
arXiv 收录
中国交通事故深度调查(CIDAS)数据集
交通事故深度调查数据通过采用科学系统方法现场调查中国道路上实际发生交通事故相关的道路环境、道路交通行为、车辆损坏、人员损伤信息,以探究碰撞事故中车损和人伤机理。目前已积累深度调查事故10000余例,单个案例信息包含人、车 、路和环境多维信息组成的3000多个字段。该数据集可作为深入分析中国道路交通事故工况特征,探索事故预防和损伤防护措施的关键数据源,为制定汽车安全法规和标准、完善汽车测评试验规程、
北方大数据交易中心 收录
Subway Dataset
该数据集包含了全球多个城市的地铁系统数据,包括车站信息、线路图、列车时刻表、乘客流量等。数据集旨在帮助研究人员和开发者分析和模拟城市交通系统,优化地铁运营和乘客体验。
www.kaggle.com 收录