登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Email_Spam_Balanced_Dataset
Email_Spam_Balanced_Dataset
收藏
kaggle
2025-06-24 更新
2025-07-12 收录
垃圾邮件分类
文献数据挖掘
数据链接:
https://www.kaggle.com/datasets/shivam09baheti/email-spam-balanced-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Balanced Dataset for Email Spam Classification Tasks
用于电子邮件垃圾邮件分类任务的平衡数据集(Balanced Dataset)
应用场景:
创建时间:
2025-06-24
相关数据集
SetFit/tweet_sentiment_extraction
情感分析
文献数据挖掘
# Tweet Sentiment Extraction Source: https://www.kaggle.com/c/tweet-sentiment-extraction/data
Hugging Face
2022-05-12 更新
17
0
sparql3WP1531.csv
知识图谱构建
文献数据挖掘
This is the result of query: PREFIX dcterms: PREFIX dc: PREFIX skos: PREFIX str: PREFIX pao: SELECT DISTINCT ?pmid COUNT(DISTINCT ?concept) AS ?count WHERE { { SELECT DISTINCT ?conc
NIAID Data Ecosystem
12
0
akhooli/mmarco_33k_test_q
自然语言处理
文献数据挖掘
这是一个包含29k查询的数据集,用于测试目的。请参阅相应的评分文件。
Hugging Face
2024-12-08 更新
7
0
Marcus2112/minipile_density-proportioned_tiny
自然语言处理
文献数据挖掘
这是一个基于The Pile Deduplicated的数据集,包含文本(text)和索引(pile_idx)两种特征。数据集被划分为训练集(train)、验证集(validation)和测试集(test),分别包含842,967、500和10,000个示例。整个数据集大小为5,279,901,670字节,下载大小为2,903,588,242字节。数据集使用英语。
Hugging Face
2025-01-23 更新
13
0
M1keR/finewiki-sv
维基百科
文献数据挖掘
该数据集包含了从维基百科抓取的页面数据,其中包括页面文本、标题、URL、修改日期、语言等信息。每个页面都标记有是否包含数学公式,并且提供了维基数据ID和HTML大小等元数据。数据集被划分为训练集,适用于自然语言处理等任务。
Hugging Face
2025-10-22 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广