FabricsCompositionDataset
收藏资源简介:
该数据集是一个用于视觉、成分和材料特性分析的纺织面料图像数据集,包含精心整理的纺织面料样本图像及结构化元数据标注。数据集共包含12,724张图像,对应44个独特的面料样本。每个面料样本均附带详细的元数据,包括纤维成分(如聚酯纤维、聚酰胺、丙烯酸、弹性纤维、棉等的百分比)、厚度、面料克重、颜色数量、图案类型、图像数量以及供应商或整理者备注。数据集采用图像文件与CSV元数据文件相结合的结构,其中annotations.csv为主要标注文件,每行对应一个面料样本,通过relative_path字段关联相应的图像文件夹或图像路径。该数据集适用于纺织图像分析、计算机视觉研究、图像检索、视觉相似性分析、元数据感知分析,以及与面料成分和材料特性相关的机器学习实验。用户需注意,多个图像可能属于同一面料样本,因此建议在划分训练/验证/测试集时按面料样本(id)而非单个图像进行,以避免数据泄漏。
数据集概述
数据集名称:Annotated Textile Fabric Image Dataset for Visual, Composition, and Material Property Analysis
数据集规模:包含 12,724 张图像,代表 44 种独特的纺织面料样品。
数据内容与结构
数据集推荐的文件结构如下:
dataset/ ├── images/ 或 fabric sample folders ├── annotations.csv ├── data_dictionary.csv ├── fiber_codebook.csv └── README.md
- 主标注文件:
annotations.csv,每一行描述一个纺织面料样品。 - 关键列:
relative_path:图像文件夹或图像文件的相对路径。id:稳定的面料样品标识符。num_colors:面料样品中可见颜色的数量。notes:原始供应商或策展人备注。weight_gsm:面料克重(克/平方米)。pattern:图案或布局类别(部分缺失)。composition:标准化的人类可读纤维成分。*_pct:数值型纤维百分比列(如 polyester_pct)。thickness_mm:面料厚度(毫米)。images:与该面料样品关联的图像数量。
- 完整列描述:参见
data_dictionary.csv。
纤维代码标准化规则
供应商缩写根据数据集特定的规则进行解释:
PA→ 丙烯酸 / 聚丙烯酸NY/Nylon→ 聚酰胺 / 尼龙EA/EL/Lycra→ 弹性纤维PES/PL→ 聚酯纤维
完整映射参见 fiber_codebook.csv。
预期用途
该数据集可用于:
- 纺织品图像分析;
- 面料视觉相似性搜索;
- 图像检索;
- 元数据感知的纺织品分析;
- 主导纤维预测;
- 多标签纤维成分分析;
- 探索性材料属性预测;
- 数据集验证和可复现的机器学习工作流。
局限性
- 部分元数据字段源自供应商备注,可能需要人工审核。
- 部分图案标签缺失。
- 多张图像可能属于同一样品,图像级别的随机切分会导致数据泄露。
- 未经额外实验室验证,不宜用于真实世界纺织品性能的声明。
推荐的数据划分策略
对于未来的机器学习实验,应按照 id(面料样品)进行划分,而非按照单张图像划分,以避免同一样品的图像同时出现在训练集和测试集中。
许可协议
- 若所有图像由数据集作者创建,适用 CC BY 4.0(允许在注明出处的情况下重复使用)。
- 若需更严格的仅研究用途发布,可考虑 CC BY-NC 4.0,但会限制商业使用。




