相关数据集
LexRAG对话数据集
该数据集包含1013个多轮对话,每个对话有5轮问题和回答。此外,还收集了来自三个不同来源的原始数据,包括法律文章、法律书籍和法律案例,作为研究人员的便利。
github2025-03-03 更新880
rkotcher/roberta_legal_experiment
该数据集包含两个主要字段:text(文本内容,字符串类型)和label(标签,int64类型)。数据集分为训练集和验证集,训练集包含214个样本,验证集包含24个样本。数据集的下载大小为39586字节,总大小为71263字节。
Hugging Face2024-05-18 更新140
dariolopez/justicio-BOE-A-1978-31229-constitucion-by-articles-multilingual-e5-large-query-groq_llama3_70b
--- dataset_info: features: - name: number dtype: int64 - name: context dtype: string - name: question dtype: string - name: answer dtype: string - name: context_qa lis
Hugging Face2024-05-30 更新110
ECHR-generation-workshop
该数据集包含多个特征,如appno、previous_text、gold_text、citations、oracle_documents_passages和top_10_passages。每个特征都有其特定的数据类型。数据集分为训练集和测试集,分别包含5000和1000个样本。数据集的大小和下载大小也有明确记录。数据集的配置名为'default',包含训练和测试数据文件的路径。
Hugging Face2024-12-01 更新320
L-NLProc/TathyaNyaya-and-FactLegalLlama-NyayaFilter-Datasets
--- license: apache-2.0 ---
Hugging Face2025-11-11 更新120



