官方服务:
资源简介:
subset indexes of xsum train set
XSum训练集的子集索引
应用场景:
创建时间:
2023-03-16
相关数据集
EULAI
EULAI是一个专注于法律文本摘要和分类的数据集,主要用于处理服务条款(ToS)和隐私政策文档。该数据集旨在帮助用户快速理解复杂的法律协议内容。数据集包含以下字段:'id'(原始内容的MD5哈希值,确保唯一性)、'service_name'(服务提供商名称,如Google、TikTok等)、'url'(原始文档链接)、'policy'(从ToS/隐私页面提取的原始法律文本,作为输入)和'summa
Hugging Face2026-01-27 更新270
luandro/mapeo-docs
该数据集包含两种配置:ingested和summarized。ingested配置包含文档ID、文本内容、文件名和文件大小。summarized配置在ingested的基础上增加了原始文档摘要、生成的摘要和摘要模型名称。数据集仅包含训练集,每个样本都包含了上述特征信息。
Hugging Face2025-04-09 更新120
imsumit18/sumaary_of_small_context_1000
--- dataset_info: features: - name: Statements dtype: string - name: summary dtype: string splits: - name: train num_bytes: 467845.58976930793 num_examples: 847 - name: tes
Hugging Face2024-03-11 更新130
llama-duo/gemma2b-it-1.1-summarize-locallm-response
--- dataset_info: features: - name: instructions dtype: string - name: target_responses dtype: string - name: candidate_responses dtype: string - name: model_id dtype: string
Hugging Face2024-06-09 更新100



