danbooru-1024-eq-captioned
收藏资源简介:
Danbooru 1024 e/q Captioned Dataset 是一个包含 59,495 张高分辨率(1024px)动漫风格图像的数据集,所有图像均来自 Danbooru 的 explicit (e) 和 questionable (q) 评级池。每张图像都附带通过 MiniMax-M3 模型生成的详细结构化 JSON 字幕。数据集结构包括原始图像目录(originals/)、字幕目录(captions/)、审查后的代理预览图像目录(proxies/)以及一个扁平化的元数据清单文件(danbooru-1024-eq-captioned.parquet),其中通过 proxy_path 字段提供审查后的预览图像,确保数据集查看器仅显示安全内容。统计信息显示:explicit 评级图像 19,367 张,questionable 评级图像 40,128 张,涉及 10,881 位不同艺术家,总大小约 29 GB。该数据集适用于文本到图像生成、动漫风格图像理解、多模态字幕生成等任务。图像版权归各自艺术家所有,字幕和元数据采用 CC-BY-SA-4.0 许可证。
The Danbooru 1024 e/q Captioned Dataset is a dataset containing 59,495 high-resolution (1024px) anime-style images, all sourced from the explicit (e) and questionable (q) rating pools of Danbooru. Each image is accompanied by a detailed structured JSON caption generated by the MiniMax-M3 model. The dataset structure includes a raw images directory (originals/), a captions directory (captions/), a censored proxy preview images directory (proxies/), and a flat metadata manifest file (danbooru-1024-eq-captioned.parquet), where the proxy_path field provides censored preview images to ensure the dataset viewer displays only safe content. Statistics show: 19,367 explicit-rated images, 40,128 questionable-rated images, involving 10,881 different artists, with a total size of approximately 29 GB. This dataset is suitable for tasks such as text-to-image generation, anime-style image understanding, and multimodal caption generation. Image copyrights belong to their respective artists; captions and metadata are licensed under CC-BY-SA-4.0.
数据集概述
Danbooru 1024 e/q Captioned Dataset 是一个包含 59,495 张 高分辨率(1024px)动漫风格图像的数据集,图像来源于 Danbooru 的 explicit(明确)和 questionable(可疑)评分池。每张图像均配有通过 MiniMax-M3 生成的结构化 JSON 描述,涵盖逐角色着装状态清单、摄像笔记、情绪调色板及后处理检测等信息。
数据集构成
| 组件 | 说明 |
|---|---|
danbooru-1024-eq-captioned.parquet |
统一的元数据清单,包含 22 列信息(艺术家、角色标签、来源作品、评分/收藏数、图像尺寸、token 使用量等),关联原始图像、代理图像和描述文件的路径 |
originals/ |
原始未修改的 Danbooru 图像,以压缩 tar.gz 归档形式存储(每个归档约 200 个 webp/jpg 文件),用于下游微调训练 |
proxies/ |
全局像素化的预览副本(JPEG 质量=40),仅供公开预览展示,不应用于训练 |
captions/ |
每张图像对应的结构化 JSON 描述文件,总计 59,495 个 |
图像描述字段
| 字段 | 说明 |
|---|---|
rating |
内容评级 |
medium |
媒介类型 |
subject_and_action |
详细场景描述 |
style_description |
情绪、光照、镜头、色彩调色板 |
characters |
逐角色对象(名称、描述、姿势、着装状态、可见身体部位、动作、目光、光照) |
captured_text |
OCR 检测到的图像内文本 |
post_processing |
检测到的后处理效果 |
数据统计
| 指标 | 数值 |
|---|---|
| 总图像数 | 59,495 |
| Explicit 评级 | 19,367 |
| Questionable 评级 | 40,128 |
| 分辨率 | 最长边 1024px |
| 独立艺术家数 | 10,881 |
| 独立角色数 | 5,044 |
| 独立来源作品数 | 3,367 |
| 平均收藏数 | 117.1 |
| 平均评分 | 66.9 |
描述生成模型
使用 MiniMax-M3(通过 OpenRouter 调用),采用结构化 JSON 提示词,包含逐角色着装状态报告和可见解剖部位清单。
许可与版权
- 图像版权归各自艺术家所有(原始发布于 Danbooru)
- 数据集仅供个人研究和微调使用
- 代理图像为衍生安全副本,不主张所有权
- 语言:英语;许可证:cc-by-sa-4.0;标签:动漫、视觉、文生图、Danbooru、explicit、JSON 描述




