官方服务:
资源简介:
Pretrained models by the sagenet package
应用场景:
创建时间:
2021-12-09
相关数据集
PTMTorrent
PTMTorrent数据集是由普渡大学和洛约拉大学芝加哥分校的研究团队创建,旨在帮助研究者评估和理解预训练模型(PTMs)包。该数据集包含来自5个不同PTM注册中心的15,913个PTM包,总数据量约61TB。数据集通过统一的数据模式进行标准化,便于跨注册中心的数据挖掘。创建过程中,研究团队从多个开放和受限的模型注册中心收集数据,并提供了完整的git克隆,确保数据的完整性和可访问性。PTMTorr
arXiv2023-03-16 更新190
Research on development of a universal diagnostic system for stator winding faults of induction motor and PMSM based on transfer learning.
Dane przedstawione w zbiorze opisują badania nad wykorzystaniem uczenia transferowego głębokiej sieci konwolucyjnej do opracowania uniwersalnego systemu diagnostyki uszkodzeń uzwojenia stojana silnika
DataCite Commons2024-03-26 更新110
chenrm/h-corpus-tokenized-qwen2.5-ctx2048
这是一个包含input_ids和attention_mask两个特征字段的数据集,主要用于训练机器学习模型。数据集被划分为训练集,大小为21758092440字节,共有2123155个样本。数据集配置中包含了默认配置,指定了训练集的数据文件路径。
Hugging Face2025-02-12 更新70
PeaTMOSS
PeaTMOSS数据集由普渡大学等研究机构创建,包含281,638个预训练模型(PTMs)的元数据,以及28,575个使用这些模型的开源软件仓库。数据集不仅记录了模型的元数据,还包括了模型在下游应用中的使用情况。通过自动提取模型元数据,如训练数据集、参数和评估指标,增强了数据集的全面性。该数据集为研究PTM供应链提供了基础,有助于理解PTM的开发趋势和文档中的常见不足,以及在软件许可方面的不一致性
arXiv2024-02-01 更新170
fineweb-edu-10BT-shuffled-for-gpt2
Tokenized Fineweb-edu (10BT, shuffled version) for pre-training GPT2 model.
kaggle2024-07-26 更新100



