登录后查看消息通知
搜索
常见问题
消息
登录
HPL LUAD 20x
收藏
Figshare
2024-02-27 更新
2026-04-08 收录
下载链接:
https://figshare.com/articles/dataset/HPL_LUAD_20x/25295638
下载链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Pre-trained weights on Barlow Twins LUAD at 20X magnification with 60% background limit
应用场景:
提供机构:
Claudio Quiros, Adalberto
创建时间:
2024-02-27
相关数据集
ConvFinQA
# Adapting Large Language Models to Domains via Continual Pre-Training This repo contains the **ConvFinQA dataset** used in our **ICLR 2024** paper [Adapting Large Language Models via Reading Compreh
魔搭社区
2026-07-14 更新
152
0
Berkeley RPT Data
RPT(Robot Pre-Training)数据集由加州大学伯克利分校的研究团队创建,旨在通过自监督的传感器-动作预训练提升机器人在真实世界任务中的学习能力。该数据集包含超过 2 万条真实世界轨迹,涵盖 9 个月的机器人操作数据,包括多视角 RGB 图像、本体感知状态和动作序列。数据集的创建过程结合了运动规划和基于模型的抓取算法,涉及经典机器人任务(如单物体抓取、料箱抓取、堆叠和解堆叠)以及物体
github
33
0
SEACrowd/melayu_sarawak
Korpus Variasi Bahasa Melayu: Sarawak 是一个语言语料库,来源于马来西亚砂拉越方言的各种民间故事。该数据集主要用于自监督预训练任务。
Hugging Face
2024-06-24 更新
20
0
SEACrowd/culturax
CulturaX是一个全面的多语言数据集,包含167种语言的6.3万亿个token,专为大型语言模型开发而设计。该数据集采用了先进的清洗和去重流程,包括语言识别和MinHash模糊去重,以确保模型训练的高质量数据。数据集以parquet格式存储,总大小为16TB,解压后为27TB,结合了最新的mC4和OSCAR语料库,特别强调非英语语言,以支持多语言模型训练。数据集的清洗验证使用了Sentence
Hugging Face
2024-06-24 更新
67
0
SEACrowd/sampiran
Sampiran是一个用于生成Pantun(一种传统的马来诗歌)的数据集。它包含7.8K条印尼语Pantun,这些Pantun从各种在线来源收集,并经过过滤以符合Pantun的一般规则,即四行诗,ABAB押韵,每行8到12个音节。
Hugging Face
2024-06-24 更新
27
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广