Turbo-AI/data-doc2query-generate
收藏官方服务:
资源简介:
该数据集包含多个字段,包括id、text、relevant、not_relevant和top。其中,relevant和not_relevant字段是列表类型,每个列表包含id和text字段。数据集被分为train分割,包含609,413个例子,总大小为2,178,365,801字节。
The dataset contains multiple fields including id, text, relevant, not_relevant, and top. The relevant and not_relevant fields are list types, each containing id and text fields. The dataset is divided into a train split, containing 609,413 examples with a total size of 2,178,365,801 bytes.
提供机构:
Turbo-AI


