ISO 20275 Entity Legal Forms (ELF) Dataset
收藏官方服务:
资源简介:
每个ISO 20275实体法律形式的清洁标准化数据集,附带免费REST API。
A clean, standardized dataset of entity legal forms as specified in ISO 20275, paired with a free REST API.
创建时间:
2026-08-10
原始信息汇总
数据集概述
该数据集是全球公司法律形式(ISO 20275 / GLEIF ELF)的规范化数据集,提供干净、标准化的实体法律形式数据,并附带免费REST API供实时查询。
核心内容
- 数据规模:包含约4,000条记录,覆盖129个国家/司法辖区
- 数据格式:同时提供CSV和JSON两种格式的静态快照文件
- 更新时间:静态快照固定于2026-04-08
- 数据来源:基于GLEIF发布的ISO 20275实体法律形式代码列表
数据字段
每条记录包含18个字段,其中部分为RegData增强字段(标记⭑):
- 基本属性:elfCode(ISO 20275代码)、countryCode(国家代码)、jurisdictionName(司法辖区)等
- 名称信息:localName(本地语言名称)、transliteratedName(拉丁转写名称)、enName⭑(标准英文名称)等
- 缩写字段:localAbbreviations(本地语言缩写)、transliteratedAbbreviations(转写缩写)、enVariations⭑(可搜索英文变体)
- 状态与追溯:elfStatus(ACTV活动/INAC停用)、dateCreated(创建日期)、modification(变更类型)、modificationDate(变更日期)、reason(变更原因)
API功能
- 名称匹配:从公司名称中识别法律形式(如输入"Rossi Costruzioni S.r.l."返回匹配结果)
- 按国家浏览:通过countryCode参数查询特定国家的法律形式列表
- 高级筛选:支持按国家、状态、ELF代码过滤,支持全文搜索和分页
- 访问方式:公共端点无需API密钥(限速、限20条记录);完整访问需API密钥
使用许可
- 底层GLEIF数据:CC0 1.0公共领域贡献
- RegData增强部分(enName、enVariations):CC BY 4.0,使用时需标注"Legal forms data by RegData, based on GLEIF ISO 20275 ELF (CC0)."
关联资源
- 数据集首页:https://github.com/Reg-Data/open-legal-forms
- ISO 20275 ELF代码列表:https://www.gleif.org/en/about-lei/code-lists/iso-20275-entity-legal-forms-code-list
- GLEIF数据使用条款:https://www.gleif.org/en/meta/lei-data-terms-of-use
- CC BY 4.0许可:https://creativecommons.org/licenses/by/4.0/
搜集汇总
数据集介绍

构建方式
该数据集基于GLEIF发布的ISO 20275实体法律形式(ELF)代码列表构建,经过系统化清洗与标准化处理,形成包含4,000条记录、覆盖129个国家或地区的综合数据集。每条记录包含18个字段,涵盖ELF代码、国家代码、司法辖区、本地名称、音译名称、语言、缩写、英文规范名称及搜索变体等。其中,英文规范名称和可搜索变体为RegData增值字段,基于原始GLEIF数据精心提炼,以增强数据的可用性与检索效率。数据以CSV和JSON两种格式提供,确保多场景下的便捷使用。
使用方法
使用者可通过两种途径获取数据:直接下载静态快照,或调用免费REST API进行实时查询。API支持按国家、状态、代码筛选,全文搜索以及名称匹配功能,无需密钥即可访问公共端点(受速率限制),完整访问需申请免费API密钥。静态文件适合离线分析与批量处理,API则适用于动态查询与集成应用。数据附有详细的Schema说明与示例,便于快速上手。
背景与挑战
背景概述
公司法律形式作为全球商业实体身份识别的基石,其标准化与规范化对于跨境合规、反洗钱监控及金融风险管控至关重要。ISO 20275标准由全球法人机构识别编码基金会(GLEIF)维护,旨在为全球各司法管辖区的实体法律形式提供统一编码,然而原始数据以电子表格形式发布,存在命名混乱、缩写不一等问题。该数据集由RegData团队于2026年创建,通过对GLEIF ELF列表进行系统清洗、归一化与丰富化处理,构建了包含4,000条记录、覆盖129个国家和地区的结构化数据集,并配套提供免费REST API接口,显著提升了法律形式数据的可获取性与可用性。此数据集的发布填补了全球法律形式数据标准化领域的空白,为金融机构、监管科技企业及研究人员提供了高质量的基础数据资源,推动了合规科技的发展。
当前挑战
该数据集面临的挑战主要集中在三个层面:其一,原始ISO 20275列表存在多语言、多脚本命名差异,同一法律形式在不同国家或语言下呈现多种变体(如S.r.l.与SRL),且部分缩写具有歧义性,需要精心设计匹配算法以实现准确识别;其二,数据构建过程中需处理格式不统一、字段类型复杂(如数组字段)及数据更新频繁等问题,确保静态快照与实时API数据的一致性和时效性;其三,法律形式的状态(活跃/废止)会随法规调整而变化,要求数据维护机制具备高响应能力,以反映最新的法律环境变动,这对数据治理与版本控制提出了严格的技术要求。
常用场景
经典使用场景
该数据集的核心应用场景在于对全球公司法定形式进行标准化识别与规范化清洗。在金融科技、企业信息管理和合规科技领域,处理跨境公司数据时,常遭遇各国法律形式命名差异巨大、缩写形式纷繁复杂(如S.r.l.、SRL、Srl等)的棘手问题。本数据集通过提供统一的ISO 20275编码、本地名称、音译名称及丰富的缩略词变体,使得研究者能够精准地从原始公司名称中剥离并识别法定形式后缀,进而获得干净、规范化的公司主体名称。这一功能对构建高质量的企业知识图谱、实现跨司法管辖区的实体匹配以及自动化数据清洗管线具有基础性支撑作用。
解决学术问题
该数据集有效解决了跨境公司数据整合中法律形式识别与归一化的学术难题。在比较法学、国际商务和计算社会科学领域,研究者常面临因法律形式表达差异而导致的实体重复、匹配错误和统计偏差等问题。该数据集的标准化编码、英文规范名称及多语言变体,为开发健壮的实体匹配算法、构建跨辖区公司可比性框架提供了权威基准。其意义在于促进了全球企业数据库间的互操作性,提升了基于大规模公司数据的研究的可重复性和准确性,为探索企业法律形式与公司治理、融资行为等议题的关系奠定了坚实的数据基础。
实际应用
在实际应用层面,该数据集被广泛集成于KYC(了解你的客户)流程、反洗钱(AML)筛查系统及供应链风险管理平台。金融机构和合规科技公司可通过API或静态文件,快速识别交易对手或客户公司名称中的法律形式,从而验证其合法存在性并评估风险。此外,数据驱动的市场情报工具利用该数据集进行公司信息聚合与去重,为商业数据库(如Crunchbase、Bloomberg)提供标准化数据源。其便捷的REST API设计也使其成为动态查询和实时更新的理想选择,显著降低了合规与数据治理的工程成本。
数据集最近研究
最新研究方向
在全球化商业生态与反洗钱(AML)及了解你的客户(KYC)合规要求日益严苛的当下,企业法律形式的标准化与智能化识别成为金融监管科技领域的前沿焦点。该数据集基于ISO 20275标准,整合了覆盖129个国家与地区的4000条实体法律形式记录,并通过增强的英文规范名称与变体字段,实现了对公司名称中法律形式的精准匹配与解析。其提供的免费REST API不仅支持实时查询与过滤,更打破了静态数据的时效性壁垒,为跨境贸易背景调查、法人身份核验及机构数据库的自动清洗提供了高效工具。这一研究不仅回应了全球法人识别编码(LEI)体系对数据互操作性的迫切需求,也为构建统一、动态的全球企业法律实体图谱奠定了关键基础,对推动国际商业透明化与金融风险防控具有深远意义。
以上内容由遇见数据集搜集并总结生成




