登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
russian jokes
russian jokes
收藏
kaggle
2024-01-13 更新
2024-03-08 收录
俄罗斯文化
网络内容分析
数据链接:
https://www.kaggle.com/datasets/kdduha/russian-jokes
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Dataset of Russian jokes (60k+), parsed from the social network VK
从社交网络VK解析获取的6万余条俄罗斯笑话数据集
应用场景:
创建时间:
2024-01-13
相关数据集
RusCode
俄罗斯文化
文本生成图像
RusCode是一个用于评估包含俄罗斯文化代码元素的文本到图像生成质量的基准数据集。数据集包含了1250个俄语文本提示及其英文翻译,覆盖了从艺术、流行文化、民间传统、名人名称、自然物体到科学成就等广泛主题。
github
2025-02-12 更新
33
0
felixZzz/dclm_1M
自然语言处理
网络内容分析
该数据集包含以下特征:bff_contained_ngram_count_before_dedupe(去重前的bff包含n-gram数量),language_id_whole_page_fasttext(整个页面的语言ID,使用fasttext表示),metadata(包含网页的元数据信息,如内容长度、内容类型、Warc记录信息等),previous_word_count(前一个单词的数量),te
Hugging Face
2025-10-20 更新
19
0
essentialweb-1.0-sample-10B
自然语言处理
网络内容分析
该数据集包含三个字段:id,原始文本(raw)和清洗后的文本(clean)。数据集分为训练集,共有约880万个示例,总大小为46331MB。
Hugging Face
2025-10-24 更新
14
0
Orkavi-Big-RSS_337m
网络内容分析
企业智能化
Orkavi-Big-RSS_337m是一个生产就绪的数据集,包含3.37亿条网络内容记录。这是完整Orkavi-Big-RSS_1.1b数据集的过滤子集,专为需要结构化网络内容智能的企业应用而设计。
github
2025-08-27 更新
26
0
Deojoandco/ah_openai_dialog
网络内容分析
对话数据
--- dataset_info: features: - name: url dtype: string - name: id dtype: string - name: num_comments dtype: int64 - name: name dtype: string - name: title dtype: string
Hugging Face
2023-06-02 更新
17
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广