登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
ml4pubmed/pubmed-classification-20k
ml4pubmed/pubmed-classification-20k
收藏
Hugging Face
2023-02-17 更新
2024-03-04 收录
文本分类
生物医学文献索引
数据链接:
https://hf-mirror.com/datasets/ml4pubmed/pubmed-classification-20k
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该数据集是来自课程的PubMed文本分类的20k子集,用于文本分类任务,语言为英语,规模在10K到100K之间,与PubMed相关。
应用场景:
提供机构:
ml4pubmed
原始信息汇总
数据集概述
基本信息
数据集名称
: ml4pubmed/pubmed-classification-20k
许可证
: Apache-2.0
任务类别
任务
: 文本分类
语言
语言
: 英语
标签
标签
: pubmed
大小
大小范围
: 10K<n<100K
具体大小
: 20k
相关数据集
bias-amplified-splits/qqp
文本分类
偏见检测
--- license: cc-by-4.0 dataset_info: - config_name: minority_examples features: - name: question1 dtype: string - name: question2 dtype: string - name: label dtype: class_lab
Hugging Face
2023-07-04 更新
21
0
Test25.txt
戏剧文学
文本分类
64 Dramen Calderón de la Barcas, txt-Dateien, UTF-8 codiert, 15 davon Komödien (Dateiname mit C beginnend), 15 Tragödien (mit T beginnend), 35 Dramen unbekannter Klassifikation (mit "Test" beginnend)
DataCite Commons
2021-08-13 更新
8
0
MNLP_M2_dpo_dataset
自然语言处理
文本分类
该数据集包含五个字段:提示(prompt)、选中(chosen)、拒绝(rejected)、数据集名称(dataset)和唯一标识符(id)。数据集划分为训练集,共有6031个示例。
Hugging Face
2025-05-26 更新
5
0
khairi/pubmed-text-04
生物医学文献索引
自然语言处理
该数据集包含来自PubMed的文章数据,每篇文章包括PubMed ID、标题和摘要。数据集分为训练集、测试集和验证集,分别包含2,345,417、1,027和500个样本。训练集的大小为2,416,644,748字节,测试集为1,051,271字节,验证集为522,261字节。总下载大小为1,400,588,219字节,数据集总大小为2,418,218,280字节。
Hugging Face
2024-12-02 更新
9
0
racism tweets
社交媒体文本
文本分类
Contains 13K tweets on racism. To classify the text.
kaggle
2021-03-02 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广