遇见数据集

云边端协作的分布式数据安全训练与预测测试数据集

收藏
官方服务:

资源简介:

本测试数据包含10万条样本的乳腺肿瘤特征数据,每个样本包含9个数值型特征(包括Clump Thickness、Uniformity of Cell Size、Uniformity of Cell Shape、Marginal Adhesion等)及对应的诊断标签(恶性/良性)。数据来源于UC Irvine机器学习库中的Breast Cancer Dataset,基于原始数据集编写Java程序,将每个样本重复生成80次并分别存储于两个边缘节点模拟分布式环境,通过数据聚合将规模扩展至10万条样本,数据量约20MB。

二维码
社区交流群
二维码
科研交流群
商业服务