遇见数据集

面向法律问题的裁判结果溯源释理模型测试数据集

收藏
官方服务:

资源简介:

面向法律问题的裁判结果溯源释理模型测试数据集用于支持裁判文书说理生成任务及实际说理内容相似度评测。该数据集基于公开裁判文书网中的裁判文书,经过基于大模型技术的数据模拟,并采用人机结合的标注方法,对“审理查明”“判决结果”“本院认为”等核心字段及案由进行标注,得到20000条测试数据。该数据集覆盖144个案由,其中刑事领域87个罪名,案例数量12000条;民事领域45个案由,案例数量7000条;行政领域12个案由,案例数量1000条。该数据集可为裁判释理模型的开发与性能测试提供系统化、可量化的验证依据。

提供机构:
上海交通大学
搜集汇总
数据集介绍
面向法律问题的裁判结果溯源释理模型测试数据集 数据集图片
背景与挑战
背景概述
该数据集是一个专为法律领域设计的测试集,旨在支持裁判结果溯源释理模型的开发与性能验证。它基于公开裁判文书,通过技术模拟和人工标注生成了20,000条测试数据,覆盖刑事、民事及行政领域的144个案由,为裁判文书说理生成及相似度评测任务提供系统化的量化评估依据。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务