登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
GG Books Dataset
GG Books Dataset
收藏
kaggle
2023-03-26 更新
2024-05-01 收录
书籍推荐
文本分析
数据链接:
https://www.kaggle.com/datasets/harikachandamollu/gg-books-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Inspired from LitRec dataset.
本数据集的设计灵感源自LitRec数据集(LitRec dataset)。
应用场景:
创建时间:
2023-03-26
相关数据集
Savoxism/SOICT-Hackathon-Dataset
文本分析
黑客马拉松
这是一个包含文本和唯一标识符的数据集,适用于训练任务。数据集包含261597个训练示例,文件大小为381574994字节。
Hugging Face
2025-03-28 更新
11
0
kBack_simple_12k_3grams
文本分析
机器学习
该数据集包含一个名为text的文本特征。它被划分为三个部分:训练集包含40000个示例,大小为159,469,936字节;测试集包含5000个示例,大小为19,956,656字节;验证集也包含5000个示例,大小为19,849,520字节。整个数据集的大小为199,276,112字节,下载大小为90,560,102字节。
Hugging Face
2025-08-29 更新
9
0
jatnikonm/finding_aids_train
文本分析
机器学习
该数据集包含文本数据,主要特征为text,数据类型为字符串。数据集分为训练集、验证集和测试集,分别包含1928、241和241个样本。训练集大小为1301882字节,验证集大小为163476字节,测试集大小为161495字节。总下载大小为372444字节,数据集总大小为1626853字节。数据文件路径分别为train-*、validation-*和test-*。
Hugging Face
2024-12-17 更新
6
0
jeremyf/tiny-imagent-200
图像处理
文本分析
--- dataset_info: features: - name: image dtype: image - name: idx dtype: int64 - name: word dtype: string splits: - name: train num_bytes: 206639400.0 num_examples: 10
Hugging Face
2024-04-24 更新
9
0
james-burton/imdb_genre_prediction_all_text
电影分类
文本分析
该数据集名为imdb_genre_prediction_all_text,包含电影相关的多个字段,如排名、标题、描述、导演、演员、年份、时长、评分、投票数、收入、Metascore以及是否为剧情片的标签。数据集分为训练集、验证集和测试集,分别包含680、120和200个样本。数据集总大小为328019字节。
Hugging Face
2023-05-02 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广