登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
tiny example Illumina read data
tiny example Illumina read data
收藏
Figshare
2023-12-12 更新
2026-04-28 收录
宏基因组去宿主化
数据预处理
数据链接:
https://figshare.com/articles/dataset/tiny_example_Illumina_read_data/24796836
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
tiny example data for GeneLab kraken2 human read removal process
应用场景:
创建时间:
2023-12-12
相关数据集
anon8231489123/ShareGPT_Vicuna_unfiltered
数据预处理
共享经济
该数据集来源于ShareGPT对话,经过筛选后保留了约53k条英文对话。清理过程包括移除非英文对话、过多的Unicode字符、重复字符以及包含特定道德化短语的对话。数据集提供了两个版本:一个移除了包含Im sorry, but的对话,另一个保留了这些对话。数据集已准备好用于训练未经过滤的Vicuna模型。
Hugging Face
2023-04-12 更新
53
0
yosubshin/walton-mm-mathinstruct-mmr1
视觉语言模型
数据预处理
这是一个结合了 Walton 和 MMR1 的视觉语言数据集,经过 data-preproc 包处理,用于视觉语言模型的训练。数据集包含了输入序列的token化ID、序列的注意力掩码、语言建模的标签、PIL图像对象、原始对话消息和处理元数据等特征。数据集共有10000个样本,处理成功率为100%。
Hugging Face
2025-10-07 更新
7
0
M5 Accuracy - Preprocessed Datasets
时序预测
数据预处理
Preprocessed datasets for preventing memory issues
kaggle
2020-05-15 更新
6
0
datajuicer/the-pile-pubmed-central-refined-by-data-juicer
数据预处理
语言模型预训练
--- license: apache-2.0 task_categories: - text-generation language: - en tags: - data-juicer - pretraining size_categories: - 1M<n<10M --- # The Pile -- PubMed Central (refined by Data-Juicer) A re
Hugging Face
2023-10-23 更新
23
0
MNIST Preprocessed
手写识别
数据预处理
Normalized (/255, mean, std) and divided into 3 datasets
kaggle
2019-07-24 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广