five

MEDED: Magi Entity Description Extraction Dataset|实体描述提取数据集|中文网页分析数据集

收藏
Mendeley Data2024-03-27 更新2024-06-27 收录
实体描述提取
中文网页分析
下载链接:
https://zenodo.org/record/3242514
下载链接
链接失效反馈
资源简介:
Magi Entity Description Extraction Dataset (MEDED) contains 500,000 (entity, description, source URL) tuples extracted by the Magi system from Chinese webpages on the Internet that are accessible from Mainland China in May 2019. These data are learned automatically and should not be considered to contain any opinion of any human individual including the authors. Main contents of the source URLs can be found in the Magi Practical Web Article Corpus.
创建时间:
2023-06-28
用户留言
有没有相关的论文或文献参考?
这个数据集是基于什么背景创建的?
数据集的作者是谁?
能帮我联系到这个数据集的作者吗?
这个数据集如何下载?
点击留言
数据主题
具身智能
数据集  4099个
机构  8个
大模型
数据集  439个
机构  10个
无人机
数据集  37个
机构  6个
指令微调
数据集  36个
机构  6个
蛋白质结构
数据集  50个
机构  8个
空间智能
数据集  21个
机构  5个
5,000+
优质数据集
54 个
任务类型
进入经典数据集
热门数据集

CE-CSL

CE-CSL数据集是由哈尔滨工程大学智能科学与工程学院创建的中文连续手语数据集,旨在解决现有数据集在复杂环境下的局限性。该数据集包含5,988个从日常生活场景中收集的连续手语视频片段,涵盖超过70种不同的复杂背景,确保了数据集的代表性和泛化能力。数据集的创建过程严格遵循实际应用导向,通过收集大量真实场景下的手语视频材料,覆盖了广泛的情境变化和环境复杂性。CE-CSL数据集主要应用于连续手语识别领域,旨在提高手语识别技术在复杂环境中的准确性和效率,促进聋人与听人社区之间的无障碍沟通。

arXiv 收录

中国沿海地面沉降数据数据库(2015,2020)

数据来源https://doi.org/10.1038/s41467-022-34525-w。由于缺少详细公开的中国沿海地区地面升降数据,本数据集是通过系统的文献综述,对中国沿海地区的地面升降进行了详细整理,建立了中国沿海城市地面沉降数据库,包括中国沿海城市不同时段沉降速率以及测量手段。所用文献主要来源于CNKI文献数据库、Web of Science,以及灰色文献(Grey literature),如报告、规划等。该数据可用于相对海平面变化研究,沿海极值水位和海岸洪水危险性研究,为沿海地面沉降防控以及沿海适应性措施规划等提供参考和依据。

国家青藏高原科学数据中心 收录

Paper III (Walker et al. 2024)

Data products used in 3-D CMZ Paper III, Walker et al. (2024). The full cloud catalogue is provided in tabular format, along with a full CMZ map showing the clouds and their assigned IDs. For each cloud ID in the published catalogue there are: - Individual cube cutouts from the MOPRA 3mm CMZ survey (HC3N, HCN, and HNCO). - Individual cube cutouts from the APEX 1mm CMZ survey (13CO, C18O, and H2CO). - Cloud-averaged spectra of the ATCA H2CO 4.83 GHz line. - PV slices of the ATCA H2CO 4.83 GHz line, taken across the major axis of the source. - Where applicable, there are mask files which correspond to the different velocity components of the cloud. In these cases, there are two mask files per velocity component, corresponding to the different masking approaches described in the paper.

DataCite Commons 收录

中国裁判文书网

中国裁判文书网是中国最高人民法院设立的官方网站,旨在公开各级法院的裁判文书。该数据集包含了大量的法律文书,如判决书、裁定书、调解书等,涵盖了民事、刑事、行政、知识产权等多个法律领域。

wenshu.court.gov.cn 收录

OpenSonarDatasets

OpenSonarDatasets是一个致力于整合开放源代码声纳数据集的仓库,旨在为水下研究和开发提供便利。该仓库鼓励研究人员扩展当前的数据集集合,以增加开放源代码声纳数据集的可见性,并提供一个更容易查找和比较数据集的方式。

github 收录