登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Beautiful Stories from Shakespeare (Text Dataset)
Beautiful Stories from Shakespeare (Text Dataset)
收藏
kaggle
2025-12-18 更新
2026-02-14 收录
莎士比亚文学
文本数据集
数据链接:
https://www.kaggle.com/datasets/doubleogon/shakespeare
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Beautiful Stories from Shakespeare – Public Domain Text
《莎士比亚优美故事集》——公有领域文本
应用场景:
创建时间:
2025-12-18
相关数据集
IAM Handwriting dataset
手写识别
文本数据集
IAM手写数据集包含由657位不同作者书写的115,320个孤立且标记的单词图像。
github
2024-03-08 更新
483
0
olmo-mix-1124
自然语言处理
文本数据集
# OLMo 2 (November 2024) Pretraining set Collection of data used to train OLMo-2-1124 models. The majority of this dataset comes from DCLM-Baseline with no additional filtering, but we provide the e
魔搭社区
2026-06-27 更新
24
0
nlp-datasets
自然语言处理
文本数据集
包含自然语言处理(NLP)相关文本数据集的字母顺序列表,主要提供免费/公共领域的文本数据集。
github
2019-03-26 更新
17
0
ArmelR/the-pile-splitted
语言模型训练
文本数据集
该数据集是一个由EleutherAI设计的800GB英文文本数据集,用于训练大规模语言模型。数据集分为22个高质量的子数据集,并通过`meta`列将数据集正确划分为子集。每个实例都有一个`domain`列,表示其所属的子集。数据集进一步被划分为训练集和测试集(97%/3%)。
Hugging Face
2023-09-06 更新
28
0
h-8m-cleaned-and-prompts
自然语言处理
文本数据集
该数据集包含三个配置文件,分别为chunk-00000、chunk-00001和chunk-00006。每个配置文件都包含两个特征:清理后的文本(cleaned_text)和提示(prompt),均为字符串类型。数据集仅包含训练集split,每个split的大小略有不同。总下载大小约为1.5GB,总数据集大小约为2.6GB。
Hugging Face
2025-09-04 更新
24
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广