登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Fashion 144K
Fashion 144K
收藏
OpenXLab
2026-04-18 收录
时尚多模态分析
时尚推荐系统
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/Fashion_144K
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Fashion 144K 是一个新颖的异构数据集,包含 144,169 个用户帖子,包含不同的图像、文本和元信息。
应用场景:
提供机构:
OpenDataLab
创建时间:
2022-05-23
相关数据集
WenetSpeech
语音识别
自然语言处理
WenetSpeech 是一个多领域的普通话语料库,由 10,000+ 小时的高质量标记语音、2,400+ 小时的弱标记语音和约 10,000 小时的未标记语音组成,总共 22,400+ 小时。作者从 YouTube 和 Podcast 收集了数据,这些数据涵盖了各种说话风格、场景、领域、主题和嘈杂的条件。引入了一种基于光学字符识别 (OCR) 的方法来为 YouTube 数据在其相应的视频字幕上
OpenDataLab
2026-07-12 更新
72
0
Pile-HackerNews
技术社区文本挖掘
自然语言处理预训练
Pile-HackerNews数据集是由Hacker News网站获取的数据构建的。 Hacker News是由初创孵化器和投资基金Y Combinator运营的链接聚合网站。 Pile-HackerNews数据集可以用于各种自然语言处理(NLP)任务和研究。
OpenXLab
8
0
MVTec D2S (MVTec Densely Segmented Supermarket)
实例感知语义分割
零售商品分割
MVTec D2S 是工业领域中实例感知语义分割的基准。它包含 21,000 张高分辨率图像,带有所有对象实例的像素标签。这些物品包括来自 60 个类别的杂货和日常用品。该基准的设计使其类似于自动结账、库存或仓库系统的真实设置。训练图像仅包含同质背景上的单个类别的对象,而验证集和测试集则更加复杂和多样化。
OpenXLab
4
0
CoWeSe (Corpus Web Salud Espanol)
生物医学
自然语言处理
CoWeSe 是一个西班牙生物医学语料库,由 4.5GB(约 7.5 亿个令牌)的干净纯文本组成。 CoWeSe 是 2020 年在 3000 个西班牙域名上执行的大规模爬虫的结果。
OpenDataLab
2026-07-12 更新
12
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广