遇见数据集

Data-Gouv-FR/liste-des-infractions-en-vigueur-de-la-nomenclature-natinf

收藏
Hugging Face2026-05-29 更新2026-05-31 收录
官方服务:

资源简介:

该数据集包含法国司法部刑事事务与赦免司更新的NATINF(国家信息命名法)中列出的所有现行刑事、海关和税务违法行为。数据以列表形式呈现,包括以下列:分配给违法行为的编号、简化违法行为定性(最多210个字符描述可惩罚行为)、违法行为性质(根据刑罚严重程度分类)、定义违法行为的法律条文引用(描述可惩罚行为)、以及规定所面临刑罚(主要和附加刑罚)的法律条文引用。由于未编纂的法律条文代码和类型在列表中以后两列缩写表示,数据集还提供了一个术语表,对应第一个文件中涉及的文本助记符或缩写,分为代码、国家未编纂文本和国际未编纂文本。现行违法行为列表每季度更新一次;文本类型列表在新法典包含刑事规定时更新。

Le fichier publié ci-dessous contient l’ensemble des infractions pénales, douanières et fiscales en vigueur recensées dans la nomenclature NATINF mise à jour par la Direction des affaires criminelles et des grâces du ministère de la justice. La liste des infractions est présentée en plusieurs colonnes: - le n° qui lui est attribué dans la nomenclature, - la qualification simplifiée de l’infraction (description du comportement punissable en 210 caractères maximum), - la nature de l’infraction (classification selon sa gravité dans l’échelle des peines), - les références des articles qui définissent l’infraction (le comportement punissable), - les références des articles qui édictent les peines (principales et complémentaires) encourues. Les codes et types de textes non codifiés étant indiqués en abrégé dans les deux dernières colonnes de la liste des infractions, un glossaire présente les libellés officiels correspondant aux mnémoniques ou abréviations des textes visés dans le premier fichier, regroupés en codes, textes non codifiés nationaux et textes non codifiés internationaux. La liste des infractions en vigueur est mise à jour chaque trimestre ; celle des types de textes est mise à jour lorsqu’un nouveau code comporte des dispositions pénales.

提供机构:
Data-Gouv-FR
搜集汇总
数据集介绍
Data-Gouv-FR/liste-des-infractions-en-vigueur-de-la-nomenclature-natinf 数据集图片
构建方式
该数据集源自法国司法部刑事与特赦事务局维护的NATINF命名体系,汇集了现行有效的刑事、海关及税务违法行为记录。数据以多列表格形式呈现,每条记录包含唯一的命名编号、违法行为简化定性(限制在210字符内描述应受惩罚行为)、违法行为性质(按刑罚严重程度分类)、定义违法行为的法律条文引用,以及规定主刑与附加刑的条文引用。此外,为辅助解读非成文法文本的缩写标识,数据集附带专用词汇表,详细说明代码、国内非成文法与国际非成文法文本的官方全称。数据集按季度更新以确保时效性。
特点
该数据集的核心特征在于其系统化的法律分类体系与规范性描述能力。通过NATINF编号唯一标识每一项违法行为,便于跨系统引用与数据整合。违法行为的性质划分严格依照法国刑罚等级,涵盖违警罪、轻罪与重罪等层级,为司法实践与统计分析提供统一基准。数据结构高度结构化,清晰区分行为定义与惩罚规定,满足法律决策支持与人工智能训练中对标准化法律知识库的需求。附加的词汇表进一步增强了非成文法文本的可解释性,降低了专业术语的歧义风险。
使用方法
该数据集适用于法律信息检索、司法判决辅助、法律知识图谱构建及自然语言处理模型训练等场景。用户可通过NATINF编号直接定位特定违法行为,或依据违法性质筛选特定严重等级的记录。结合法律条文引用字段,可快速关联对应的法典与判例,支持跨文本分析。词汇表则为解析文本缩写提供映射,适用于开发法律自动化问答系统或合规审查工具。数据以结构化格式公开,可通过自动化脚本定期获取更新版本,确保与现行法律体系同步。
背景与挑战
背景概述
法国刑事犯罪分类体系(Nomenclature des Infractions,简称NATINF)由法国司法部刑事事务与赦免局创建并持续维护,其核心研究问题在于为法国刑法体系中的各类犯罪、违章及违法行为提供一套统一、标准化的编码与分类框架。该数据集以季度为周期更新,收录了现行有效的刑事、海关及税务违法行为的完整清单,每条记录包含NATINF编号、罪行简化描述、违法性质(按刑罚严重程度分类)、定义罪行的法律条文以及规定主刑和附加刑的条文引用。自发布以来,该数据集已成为法国司法系统、执法机构及法律研究领域的重要参考工具,推动了刑事数据的规范化治理与跨机构协作。
当前挑战
该数据集所解决的领域挑战集中于刑法信息标准化与可操作性之间的鸿沟:法国刑法体系涵盖众多法律文本(法典、非编纂国内法、国际条约),其条文引用复杂且描述冗长,导致司法实践中对罪行的认定与量刑参考效率低下。通过构建NATINF统一编码,数据集实现了对分散法律规范的聚合与精简描述(每条不超过210字符),但构建过程中面临两大挑战:一是如何准确提取并压缩刑法条文中的关键要素,确保描述不失法律原意;二是处理非编纂文本(如国际公约)的缩写与术语统一,需配套生成术语表以实现跨文本的互操作。此外,季度更新机制要求维护团队持续追踪新刑法规范的颁布与旧条文的废止,维持数据集的时效性与完整性。
常用场景
经典使用场景
NATINF命名法是法国刑事司法体系的基石,该数据集收录了法国现行刑法、海关法和税务法中的所有违法行为,涵盖违章、轻罪与重罪三大类别。研究者可据此构建违法行为分类系统,通过解析每项违法行为的编号、简化定性、法律依据及刑罚条款,实现违法行为的标准化识别与检索。在司法大数据分析中,该数据集常被用于自动化法律文书处理、量刑预测模型训练以及法律知识图谱的构建,成为连接法律条文与计算机理解的关键纽带。
衍生相关工作
围绕该数据集衍生出一系列经典工作,包括基于NATINF编码的法律文书自动分类模型,如采用BERT架构的法语司法判决预训练模型。研究者还构建了违法行为关联图谱,揭示不同违法类型之间的共现模式与刑罚关联性。此外,有工作利用该数据集中的历史版本对比,开发法律条文变更追踪系统,自动识别并标注新增、修改或废止的违法行为。在开源社区中,基于该数据集的API接口设计使得实时查询违法信息成为可能,推动了法律数据基础设施建设。
数据集最近研究
最新研究方向
该数据集专注于法国刑事、海关及税务现行违法行为的标准化分类体系,即NATINF命名法,由法国司法部刑事与特赦局定期更新。在计算法学与知识图谱的前沿交叉领域,该数据集正被用于构建系统化的法律知识本体,以支持司法自动化裁决、法律文本结构化解析及智能司法助手等应用。随着欧盟倡议的“数字十年”战略推进,基于此类命名法的语义标注与跨文本推理成为热点,旨在提升法律检索效率、减少判例冲突,并为透明公正的司法决策提供量化基础,其影响深远至重塑法律科技生态与促进欧洲司法数字化协同。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务