louisbrulenaudet/livre-procedures-fiscales
收藏官方服务:
资源简介:
Livre des procédures fiscales数据集专注于通过微调预训练语言模型来创建高效且准确的法律实践模型。数据集的内容包括法律条文的指令、输入、输出、生效日期、过期日期和文章编号。数据集生成过程中使用了多种指令来指导模型生成法律条文的内容。该数据集适用于文本生成、表格问答、摘要、文本检索、问答和文本分类等任务。
The Livre des procédures fiscales dataset focuses on fine-tuning pre-trained language models to create efficient and accurate models for legal practice. The dataset includes instructions, inputs, outputs, effective dates, expiration dates, and article IDs for legal provisions. The dataset generation process uses various instructions to guide the model in generating the content of legal provisions. This dataset is suitable for tasks such as text generation, table question answering, summarization, text retrieval, question answering, and text classification.
提供机构:
louisbrulenaudet原始信息汇总
数据集概述
基本信息
- 许可证: Apache-2.0
- 语言: 法语
- 多语言性: 单语种
- 标签: 微调、法律、法国法律、法国税法程序书
- 来源: 原始数据
- 美观名称: 法国税法程序书
任务类别
- 文本生成
- 表格问题回答
- 摘要生成
- 文本检索
- 问答
- 文本分类
规模
- 数据集大小: 1K<n<10K
数据集生成
- 数据集由JSON格式文件组成,每个条目包含以下字段:
instruction: 字符串,关联元素的指令。input: 字符串,元素的输入详情。output: 字符串,元素的输出信息。start: 字符串,文章生效日期。expiration: 字符串,文章失效日期。num: 字符串,文章ID。
微调方法
- 采用指令基础的微调方法,通过人类提供的指令指导模型行为,提高模型在特定任务上的适应性和输出质量。
搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集是法国《税务程序法规》(Livre des procédures fiscales)的结构化文本集合,包含973行数据,以表格和文本模态呈现,适用于文本生成、表格问答和摘要等自然语言处理任务。数据集以法语编写,具有法律和微调标签,旨在提供更新、简化的法律文本访问,支持法律AI模型的训练和集成。
以上内容由遇见数据集搜集并总结生成



