CaseHOLD
收藏OpenCSG2024-07-17 更新2026-01-19 收录
下载链接:
https://opencsg.com/datasets/MagicAI/CaseHOLD?tab=summary
下载链接
链接失效反馈官方服务:
资源简介:
预训练语料库是通过摄取从1965年至今的整个哈佛法学院案例语料库构建的。这个语料库(37GB)的大小很大,代表了所有联邦和州法院的3,446,187个法律判决,并且比最初用于训练BERT的BookCorpus/Wikipedia语料库(15GB)的大小还要大。我们从这个语料库中随机抽取 10% 的决策作为保留集,我们用它来创建 CaseHOLD 数据集。剩下的 90% 用于预训练。
提供机构:
MagicAI
创建时间:
2024-07-17



