遇见数据集

Data-Gouv-FR/base-carbone-r-2

收藏
Hugging Face2026-05-29 更新2026-05-31 收录
官方服务:

资源简介:

Base Carbone® 是一个公开的排放因子数据库,用于进行温室气体(GES)排放核算和一般碳会计工作。它是法国Grenelle II法律第75条(要求超过500名员工的企业、超过250名员工的公共机构以及超过5万居民的社区进行GES核算)的参考数据库。该数据库由ADEME管理,治理涉及多方利益相关者,包括生态与团结转型部(MTES)、法国企业运动(MEDEF)、气候行动网络(RAC)、气候咨询专业人士协会(APCC)等14个成员。版本为base carbone® V23.6,详细信息可参考相关修改跟踪文件。完整文档可在Base Empreinte网站的Base Carbone部分找到,以确保数据使用的稳健性。如有问题,请联系base-empreinte@ademe.fr。

Base Carbone® is a public database of emission factors, necessary for conducting greenhouse gas (GHG) emission inventories and more generally any carbon accounting exercise. It is the reference database for Article 75 of the Grenelle II law, which requires GHG inventories for companies with over 500 employees, public institutions with over 250 agents, and communities with over 50,000 inhabitants. Managed by ADEME, its governance is multi-stakeholder, comprising 14 members such as the Ministry of Ecological and Solidarity Transition (MTES), the French Business Confederation (MEDEF), the Climate Action Network (RAC), the Association of Climate Consulting Professionals (APCC), etc. Version is base carbone® V23.6, with details on modifications available in the tracking file. The complete description and documentation explaining the scope and sources of the data can be found in the Base Carbone section of the Base Empreinte website to ensure robust use of the data. For any questions, contact base-empreinte@ademe.fr.

提供机构:
Data-Gouv-FR
搜集汇总
数据集介绍
Data-Gouv-FR/base-carbone-r-2 数据集图片
构建方式
Base Carbone®数据集源自法国官方开放数据平台data.gouv.fr,由法国环境与能源管理局(ADEME)主导构建,遵循lov2许可协议。该数据集以HuggingFace格式重新组织,将原始数据资源中的表格数据映射为独立的HuggingFace子集配置,每个子集包含一个名为“train”的数据拆分。数据集采用Parquet格式存储,具体文件位于“data/fichier.parquet”路径下,确保了高效的数据压缩与读取性能。其构建过程紧密围绕法国《格勒诺布尔II法》第75条对温室气体排放清单编制的法定要求,汇聚了多利益相关方(包括生态转型部、法国企业运动、气候行动网络等)的共识,形成了权威的排放因子数据库。
特点
该数据集的核心特点在于其作为法国官方温室气体排放因子基准数据库的权威地位,版本号为V23.6,承载了企业、公共机构及社区履行排放清单法定义务所需的标准化参数。数据集采用HuggingFace的标准化配置结构,支持通过Python的datasets库直接加载,提供了简洁的train拆分访问接口。数据以Parquet格式存储,兼具列式存储的查询效率与压缩优势,适合大规模分析场景。此外,数据集附带了详细的版本变更追踪文档(如V23.5至V23.6的修订日志),并提供了完整的元数据描述和来源说明,强调了透明性和可追溯性,确保用户能够根据文档理解排放因子的计算边界与数据来源。
使用方法
使用该数据集时,用户可通过HuggingFace的datasets库轻松加载,示例代码为:`from datasets import load_dataset; ds = load_dataset('Data-Gouv-ML/base-carbone-r-2', 'fichier'); print(ds['train'])`。数据集默认提供名为“fichier”的子集配置,直接调用即可获取包含所有排放因子的训练拆分。用户可在Python环境中对加载后的数据集对象进行迭代、过滤或分析操作。官方建议结合Base Empreinte网站上的完整文档使用,以深入理解各排放因子的定义、数据来源及适用场景,从而确保在温室气体核算中的稳健应用。对于任何疑问,可通过base-empreinte@ademe.fr联系数据维护团队。
背景与挑战
背景概述
Base Carbone®是法国生态转型与团结部(MTES)与法国环境与能源管理署(ADEME)于2012年联合创建的公共碳排放因子数据库,旨在为《格勒诺布尔II法案》第75条所规定的企业及公共机构温室气体排放清单编制提供标准化参照。该数据集整合了14个治理机构(包括法国企业运动联盟MEDEF、气候行动网络RAC等)协作开发的排放因子体系,覆盖能源、工业、农业等关键经济领域的全生命周期碳排放数据。作为法国乃至欧盟碳核算体系的核心基础设施,它支撑着超过500名雇员的企业及5万人口以上行政区的强制性碳报告制度,其V23.6版本更通过精细化分类实现了对巴黎协定减排目标的精准对标。
当前挑战
该数据集面临的核心领域挑战在于如何平衡排放因子的普适性与行业特异性:工业流程的异质性导致统一因子难以适配化工、冶金等复杂产业链的碳排放测算,而农业部门因气候、土壤变量产生的动态排放系数更增加了模型泛化难度。构建过程中,数据持有者需持续整合法国国家工业排放数据库(IREP)等20余个异构源数据,应对年度修订版本(如V23.6)中因子精度提升带来的存储与版本追溯挑战,同时需确保因法国公共数据开放许可(lov2)框架下的数据一致性,杜绝对本土企业商业机密的潜在泄漏风险。
常用场景
经典使用场景
Base Carbone® 数据集是法国环境与能源管理署(ADEME)发布的权威碳排放因子数据库,核心用途在于支持企业和公共机构编制温室气体(GES)排放清单。该数据集涵盖能源、交通、农业、废弃物处理等多个领域的排放因子,为量化组织或产品的碳足迹提供了标准化的参考基准。研究人员常将其用于构建碳排放核算模型,评估不同经济活动对环境的影响,或作为生命周期评价(LCA)的关键输入数据。其经典的使用方式是通过Python的datasets库加载数据,结合排放源活动数据进行乘积计算,从而得到可靠的排放总量。
解决学术问题
该数据集有效解决了学术界在碳排放因子数据获取上的碎片化和非标准化难题。此前,不同机构常使用来源各异、口径不一的排放因子,导致研究结果难以横向比较和验证。Base Carbone® 提供了统一、公开且经多利益相关方审核的数据源,极大提升了碳足迹研究的重复性和可比性。它支撑了法国《格勒诺布尔II法》第75条的实施,推动了企业碳核算的标准化进程,并在国际学术研究中作为法国乃至欧洲区域排放因子的权威参考,助力气候变化政策评估、绿色供应链管理及减排路径优化等前沿课题的深入开展。
衍生相关工作
围绕Base Carbone® 数据集,衍生出了一系列重要的研究工作。在方法论上,学者提出了基于该数据库的投入产出混合分析模型,用于评估部门间间接碳排放的传递效应。在应用层面,有研究将其与交通流量大数据结合,构建城市级实时碳排放监测系统。法国国家科学研究中心(CNRS)的团队利用该数据的排放因子,开发了针对建筑行业的生命周期环境影响评估工具。此外,针对数据集本身的更新迭代,ADEME发布了版本追踪文档(如V23.5至V23.6的变更记录),这些文档常被用于分析排放因子时间序列变化及其对政策响应的敏感性,揭示碳核算科学体系的演进脉络。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务