nebula-graph-shareolding-dataset
收藏资源简介:
这是一个关于股权关系穿透的数据集,包含了公司和个人之间的股权关系,以及公司之间的分支关系和股权持有情况。数据集通过随机生成的方式创建,用于图数据库Nebula Graph的示例和演示。
This is a dataset concerning equity relationship penetration, encompassing equity relationships between companies and individuals, as well as branch relationships and equity holdings among companies. The dataset is created through random generation and is intended for use as an example and demonstration in the graph database Nebula Graph.
数据集概述
数据模型
数据集中的关系简化为两种实体类型:person 和 corp,以及以下关系类型:
person持有corp的股份百分比为{share} %person与另一个person有亲属关系corp持有另一个corp的股份百分比为{share} %corp可以是另一个corp的分支person可以担任corp的角色
在 Nebula Graph 中,这些关系通过以下 SQL 语句定义:
sql CREATE TAG person(name string); CREATE TAG corp(name string); CREATE EDGE role_as(role string); CREATE EDGE is_branch_of(); CREATE EDGE hold_share(share float); CREATE EDGE reletive_with(degree int);
数据生成
数据集通过 data_generator.py 脚本随机生成,生成的数据存储在 .csv 文件中,这些文件包括:
corp.csvcorp_rel.csvcorp_share.csvperson.csvperson_corp_role.csvperson_corp_share.csvperson_rel.csv
数据导入
使用 Nebula-Importer 工具将 .csv 文件中的数据导入到 Nebula Graph 数据库中。导入过程通过 nebula-importer.yaml 配置文件进行配置。
查询示例
在 Nebula Graph 中,可以通过 nGQL 语言查询公司 c_132 的所有关系,示例查询如下:
sql GO 1 TO 3 STEPS FROM "c_132" over * BIDIRECT
此查询将返回与 c_132 相关的所有实体和关系。




