hssd-annotations
收藏资源简介:
HSSD Annotations数据集是hssd-annotations API的大数据文件层,包含10,963个资产的完整功能标注数据。该数据集提供了大规模的功能掩码和记录文件,这些文件因体积过大而未包含在GitHub代码仓库中。数据集包含两个关键更新:2026年7月20日的物理/质量审计更新,修正了469个类别的碰撞检测和质量先验;以及自发光光度审计更新,为所有记录添加了自发光注释,识别了1,190个发光资产(包括998个灯具、63个发光显示器和129个火焰),并提供基于物理单位(瓦特、流明、坎德拉等)的渲染先验。数据内容主要包括功能掩码(NPZ格式)、功能记录(JSON格式)、合并记录文件、查找表、后替换清单等。数据集源自HSSD和PartNet-Mobility,遵守相应的上游许可证,不包含网格几何数据。该数据集需与GitHub代码库结合使用,以实现完整的API功能,包括搜索、获取、统计、间隙计算、关系分析、自由度处理、规范前向/方向确定和后替换等功能。适用任务包括场景生成、功能推理、间隙分析、物理模拟和自发光渲染等。
The HSSD Annotations dataset is a big data file layer for the hssd-annotations API, containing complete functional annotation data for 10,963 assets. It provides large-scale functional masks and record files that are too large to be included in the GitHub code repository. The dataset includes two key updates: a physical/quality audit update on July 20, 2026, which corrected collision detection and quality priors for 469 categories; and a self-luminous photometric audit update, which added self-luminous annotations to all records, identifying 1,190 luminous assets (including 998 lights, 63 luminous displays, and 129 flames), and providing rendering priors based on physical units (watts, lumens, candelas, etc.). The data mainly consists of functional masks (NPZ format), functional records (JSON format), merged record files, lookup tables, and post-replacement lists. The dataset originates from HSSD and PartNet-Mobility, adheres to the corresponding upstream licenses, and does not include mesh geometry data. It must be used in conjunction with the GitHub codebase to achieve full API functionality, including search, retrieval, statistics, gap calculation, relationship analysis, degree-of-freedom processing, canonical forward/direction determination, and post-replacement. Applicable tasks include scene generation, functional reasoning, gap analysis, physical simulation, and self-luminous rendering.
数据集概述:HSSD Annotations (full data layer)
- 数据集名称:HSSD Annotations (full data layer)
- 数据集地址:https://huggingface.co/datasets/P-Kevin/hssd-annotations
- 许可协议:other(需遵守上游 HSSD 和 PartNet-Mobility 的许可)
- 任务类型:other
- 标签:hssd, partnet-mobility, affordance, clearance, scene-generation, articulation
数据集描述
该数据集是 HSSD 注释的全量数据层,与 K-Chronofox/hssd-annotations GitHub 仓库配套使用。GitHub 仓库包含代码(hssd_asset_library:存储 + CLI + REST)、核心查找表以及 12 个资产的样本;本数据集提供完整的 10,963 个资产的功能性注释层,不包含网格几何体。
主要内容与文件
| 文件 | 大小 | 说明 |
|---|---|---|
affordance_masks.tar.gz |
~477 MB | 10,963 个 NPZ 格式功能掩码(masks/hssd_<id>.npz) |
affordance_records.tar.gz |
~4 MB | 10,963 个 JSON 格式功能记录(records/HSSD_<id>.json)——标签、部件功能、访问方向、功能依赖 |
records.jsonl |
~81 MB | 全部 10,963 条合并后的资产记录(未压缩) |
hssd_annotation_lookup.json.gz |
~5.8 MB | 完整合并的查找表(与 GitHub 仓库相同) |
post_replacement_manifest.json |
~0.9 MB | 静态 ID 到铰接实现(T1 官方 / T2-PM)的映射 |
index.jsonl |
~1.5 MB | 功能 asset_id 到记录路径的索引 |
functional_dependency_priors.jsonl、functional_descriptions.jsonl |
小 | 类别级先验 |
LAYER_SUMMARY.json |
极小 | 功能层摘要 |
SELF_EMISSION_SUMMARY.json |
极小 | 全覆蓋自发光计数与概况 |
SELF_EMISSION_AUDIT.json |
极小 | 全面审计:字段、公式、来源、GLB 材质 |
SELF_EMISSION_PROFILE_AUDIT.csv |
极小 | 每个光度剖面一行 |
self_emission_profiles.json |
极小 | 版本化、有来源支持的工程先验 |
HSSD_SELF_EMISSION_AUDIT_AND_API.md |
极小 | 独立的自发光实现与审计响应文档 |
HSSD_ASSET_NORMALIZATION_ANNOTATION_RESPONSE.md |
极小 | 对材质/质量/摩擦/质量要求的响应 |
ANNOTATION_RETRIEVAL_GUIDE.zh.md |
极小 | 中文 ID 优先的 Python/CLI/REST 及全层检索指南 |
数据来源与审计
- 物理/质量审计(2026-07-20):基于
category-dimension-render-v2-20260720,对所有 469 个类别的原始子串类别冲突和长尾质量先验进行了修正。审计文件包括ASSET_PHYSICS_QUALITY_AUDIT.json(详尽 ID/公式/渲染筛查)和ASSET_PHYSICS_CATEGORY_AUDIT.csv(类别级质量分布)。这些是仿真先验,带有明确置信度,非直接测量。 - 自发光光度审计(2026-07-20):所有 10,963 个记录均包含
self_emission注释。识别出 1,190 个发光资产(998 个灯具、63 个发光显示器和 129 个火焰),提供以物理单位(瓦特、流明、坎德拉、坎德拉/平方米)表示的渲染器就绪先验。审计文件包括SELF_EMISSION_AUDIT.json、SELF_EMISSION_PROFILE_AUDIT.csv和HSSD_SELF_EMISSION_AUDIT_AND_API.md,审计报告无缺失记录、无剖面不匹配、无光度计算不匹配、无效数值或未解决的发光体类别候选者。
注释家族
- 功能相关:功能标签、功能掩码、部件级功能、访问方向、间隙、关系、放置自由度、白名单/合作伙伴、操作空间(参考)、规范正面、替换后实现。
- 物理相关:材质、质量、摩擦、质量、自发光光度。
使用方式
需要与 GitHub 仓库结合使用:
bash
1) 获取代码和核心查找表
git clone https://github.com/K-Chronofox/hssd-annotations.git cd hssd-annotations
2) 下载本数据集的全量数据层
hf download P-Kevin/hssd-annotations --repo-type dataset --local-dir /tmp/hssd-full
3) 解压功能层到仓库数据目录
tar -xzf /tmp/hssd-full/affordance_masks.tar.gz -C data/affordance tar -xzf /tmp/hssd-full/affordance_records.tar.gz -C data/affordance cp /tmp/hssd-full/records.jsonl data/
4) 可对全部 10,963 个资产使用 get_affordance()/expand=True
python -c "from hssd_asset_library import AssetLibrary; print(AssetLibrary().get(<hssd_id>, expand=True)[affordance_full][parts][0])"
核心 API(搜索、获取、统计、间隙、关系、自由度、规范正面/朝向、替换后)直接从 GitHub 仓库即可使用,本数据集仅用于全量资产级功能记录和 NPZ 掩码。





