登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Pride & Prejudice clean dataset
Pride & Prejudice clean dataset
收藏
kaggle
2021-05-21 更新
2024-03-08 收录
文学分析
自然语言处理
数据链接:
https://www.kaggle.com/datasets/theeranartmeesathien/pride-prejudice-clean-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Preprocessed Pride & Prejudice novel and subtitles
经过预处理的《傲慢与偏见》(Pride & Prejudice)小说与字幕文件
应用场景:
创建时间:
2021-05-21
相关数据集
oda-99/wiki_tail_5_vowel_hira
自然语言处理
韵律分析
该数据集包含多个特征字段,包括section(部分)、rhyme(韵律)和new_text(新文本),其中rhyme和new_text是字符串序列。数据集分为训练集和测试集,训练集包含1,853,385个样本,测试集包含205,932个样本。数据集的下载大小为218,102,166字节,总大小为389,239,324字节。数据文件的默认配置路径分别为训练集的data/train-*和测试集的dat
Hugging Face
2024-11-17 更新
18
0
shossain/merged-no-pad-16384
自然语言处理
机器学习
--- dataset_info: features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequence: int64 splits: - name: train num_bytes: 12260640
Hugging Face
2023-11-06 更新
7
0
AbderrahmanSkiredj1/ahadith_translation_34k
圣训翻译
自然语言处理
该数据集包含三个特征:文本(text)、标签(label)和提示(prompt),数据类型均为字符串。数据集包含一个训练集(train),大小为56339232字节,包含34088个样本。下载大小为19500537字节,数据集总大小为56339232字节。数据集的任务类别为翻译(translation),语言为阿拉伯语(ar)。
Hugging Face
2024-07-15 更新
6
0
marcelomoreno26/leniachat-qwen2-1.5B-v0-AQuAS
自然语言处理
机器学习
该数据集包含三个字段:参考回复(reference)、实际回复(answer)和上下文(context),均为文本格式。数据集目前只有训练集部分,包含107个示例,文件大小为537370字节。数据集的下载大小为149134字节。未提供详细的数据集用途或背景信息。
Hugging Face
2025-02-10 更新
12
0
srbdtwentyfour/three_parts_cleaned
自然语言处理
对话系统
--- dataset_info: features: - name: id dtype: int64 - name: prompt dtype: string - name: response dtype: string - name: model dtype: string splits: - name: train num_
Hugging Face
2024-06-09 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广