ipfs_bolivia_laws
收藏资源简介:
玻利维亚法律数据集(Laws of Bolivia)是一个收集自玻利维亚官方公报(Gaceta Oficial de Bolivia)的法律文本快照数据集。数据以 Parquet 格式存储,包含两个配置:laws 和 articles。laws 配置每行对应一部法律或文书,包含字段:ID、标题、全文、日期、状态、标识符、条款数量、来源URL;articles 配置每行对应一条条款,包含字段:法律ID、条款编号、标题、文本、来源URL。数据集规模为1332部法律和13242条条款,语言为西班牙语,适用于法律文本检索、分析等自然语言处理任务。注意:该数据集非官方整合,不构成法律建议,官方文本优先。
The Laws of Bolivia dataset is a snapshot of legal texts collected from the Official Gazette of Bolivia (Gaceta Oficial de Bolivia). The data is stored in Parquet format and includes two configurations: laws and articles. The laws configuration corresponds to each law or document, with fields: ID, title, full text, date, status, identifier, number of articles, source URL. The articles configuration corresponds to each article, with fields: law ID, article number, title, text, source URL. The dataset contains 1,332 laws and 13,242 articles, in Spanish, suitable for legal text retrieval, analysis, and other natural language processing tasks. Note: This dataset is not an official compilation, does not constitute legal advice, and official texts take precedence.
数据集概述:玻利维亚法律(Laws of Bolivia)
该数据集是玻利维亚官方立法的研究快照,内容来源于玻利维亚官方公报(Gaceta Oficial de Bolivia),旨在为研究目的提供结构化文本数据。请注意,该数据集不构成官方合编版,也不提供法律建议,一切以官方公报或政府门户网站发布的内容为准。
基本信息
- 数据集名称:玻利维亚法律(Laws of Bolivia)
- 语言:西班牙语(
es) - 司法辖区:玻利维亚(Bolivia)
- 许可证:
bo-gaceta-oficial(属于“其他”类别,非标准许可证) - 任务类型:文本检索(text-retrieval)
- 标签:法律、立法、玻利维亚、官方文本
数据规模与覆盖
| 项目 | 数量/说明 |
|---|---|
| 快照日期 | 2026-09-07 |
| 覆盖范围 | 基于目录、不完整(catalog-backed incomplete) |
| 法律/文书数量 | 1452 部 |
| 条款数量 | 13924 条 |
| 文件数量 | 约 1K–10K(1,000~10,000) |
| 数据格式 | Parquet 文件 |
数据集内容与结构
数据集包含两个配置(config),均以Parquet格式存储:
-
laws(默认配置) — 文件路径:data/laws.parquet- 每一行对应一部法律/文书,字段包括:
- 标识(id)
- 标题
- 全文文本
- 日期
- 状态
- 标识符
- 条款数量
- 来源URL
- 每一行对应一部法律/文书,字段包括:
-
articles配置 — 文件路径:data/articles.parquet- 每一行对应一个条款或章节,字段包括:
- 所属法律编号(
law_id) - 条款编号
- 标题
- 文本内容
- 来源URL
- 所属法律编号(
- 每一行对应一个条款或章节,字段包括:
采集与构建信息
- 数据来源:玻利维亚官方公报(Gaceta Oficial de Bolivia)
- 采集器脚本:
scrapers/collect_bo.py— 用于构建此快照的研究级采集器scrapers/common.py— 共享采集辅助函数scrapers/world_lib.py— 共享抓取逻辑(直接访问官方URL,失败时回退到Wayback Machine)scrapers/archive_fallbacks.py— 用于Wayback Machine / Common Crawl CDX的辅助函数
许可与重用说明
- 官方政府/公报文本的再利用需遵循原始门户网站的公共部门条款。
- 此数据集的打包、元数据及采集脚本仅供研究用途使用。
- 该数据集不是官方合编版,也不是法律建议,官方来源具有优先效力。




