遇见数据集

Open Image Prompts

收藏
github2026-07-26 更新2026-07-27 收录
官方服务:

资源简介:

一个开放、本地优先的视觉提示存档,包含14,899条源提示、25,474张图像、29,798条翻译、172,770个活动v2提示标签和185个视觉标签的封闭分类法。数据集资产通过GitHub Releases分发,包括SQLite存档和可选的月度图像包,支持本地预览和检索。

An open, local-first visual prompt archive containing 14,899 source prompts, 25,474 images, 29,798 translated entries, 172,770 active v2 prompt tags, and a closed taxonomy of 185 visual tags. The dataset assets are distributed via GitHub Releases, including the SQLite archive and optional monthly image packages that support local preview and retrieval.

创建时间:
2026-07-24
原始信息汇总

数据集概述:Open Image Prompts

Open Image Prompts 是一个开源的、本地优先的视觉提示存档库,旨在提供可追溯的提示-图像参考数据。

核心数据规模

  • 提示来源: 14,917 条
  • 图像: 25,499 张
  • 翻译: 29,834 条
  • 活跃提示标签 (v2): 172,984 个
  • 视觉标签分类体系: 185 个标签

数据内容与边界

  • 包含内容:
    • 源提示 (source prompts) 及源 URL
    • 完整公共语料库的图像记录
    • 双语翻译
    • 活跃的 oip-visual-v2 提示/图像标签
    • 公共分类法及全文搜索 (FTS) 索引
  • 不包含内容:
    • 标记候选、模型/提供者设置、运行 ID、租赁、模型理由、错误路径、评估表或旧版标签分配

数据资产管理

  • 存储方式: 数据集资产通过 GitHub Releases 发布(非 Git LFS)。
  • 仓库与数据分离: Git 仓库仅跟踪应用代码、前端、API、技能、分类法和小型数据集索引。大型数据库文件和图像包不提交到 Git 历史中。
  • 关键文件:
    • db/prompts.db.gz: 压缩的公共 SQLite 数据库(约 80 MB)
    • images/: 解压后的月度图像包(总计约 4.3 GB)
    • data/dataset-manifest.json: 资产清单文件
    • data/public-corpus.json: 公共语料库清单
  • 下载方式:
    • 完整下载: npm run data:pull
    • 仅下载数据库: npm run data:pull:dbpython3 scripts/fetch_dataset.py --db-only

主要功能与技能

  • img-gen-taste: 将粗略需求转化为清晰的艺术指导。
  • img-gen-prompts: 检索可追溯的提示-图像参考,并打开本地比较图库。
    • 支持搜索功能,例如:python3 skills/img-gen-prompts/scripts/oip.py search --intent "vintage city travel poster" --limit 5

验证与状态

  • 可通过 npm run status 检查运行状态,确认 "active_taxonomy_version": "oip-visual-v2""ready": true
  • 提供回归基准测试:npm run test:retrieval

许可协议

  • 应用代码和技能指令:MIT License (LICENSE)
  • 数据集许可和第三方内容边界:DATA_LICENSE.md
搜集汇总
数据集介绍
Open Image Prompts 数据集图片
构建方式
Open Image Prompts 数据集以开放、本地优先为核心理念构建,通过 GitHub Releases 分发资源。其核心数据存储于 SQLite 数据库中,包含 14,917 条源提示、25,499 张图像、29,834 条翻译以及 172,984 个活跃的 v2 提示标签,并依托一套由 185 个视觉标签构成的封闭分类体系。数据集资产通过脚本 fetch_dataset.py 下载,支持仅获取数据库文件或完整图像包,并采用 SHA256 哈希校验确保数据完整性。仓库仅追踪代码与轻量元数据,大型文件通过发行版管理,实现版本迭代的轻量化。
特点
该数据集具备鲜明的本地优先与开放特性,所有数据通过提示与图像的多模态关联构建,提供双语翻译和精细化的视觉标签体系。搜索工具基于精确匹配与相关结果双通道机制,在稀疏覆盖场景下仍能提供图像验证的参考。数据集严格控制公共边界,仅包含运行时所需的生产数据,排除了模型配置、运行日志等中间产物,确保数据纯净。整体设计强调可追溯性,每个提示都对应可验证的图像来源,为艺术方向探索提供可靠依据。
使用方法
数据集使用方式多元且便捷。用户可通过一键启动脚本 start.sh(macOS/Linux)或 start.bat(Windows)自动完成环境配置与数据下载。如需深度检索,可利用命令行工具 oip.py 执行精确或语义搜索,例如查询特定美学意图并限定返回条数。内置的回归测试脚本 test:retrieval 支持批量验证检索效果。对于开发者,数据集还提供了兼容编码代理的接口,通过 Skills 模块如 img-gen-prompts 实现与 SQLite 数据库的接口化交互,同时支持 Docker 容器化部署以隔离运行时环境。
背景与挑战
背景概述
Open Image Prompts数据集由NanmiCoder团队开发,发布于2024年,旨在构建一个开放、本地优先的视觉提示档案库。该数据集的核心研究问题是如何通过结构化的视觉标签与双语翻译,将模糊的创意简报转化为清晰的图像生成指令,并支持可追溯的提示-图像对检索。数据集包含14,917条原始提示、25,499张图像、29,834条翻译以及172,984个活跃的视觉标签,其封闭的185个视觉标签分类体系为图像生成领域提供了标准化的语言参考。作为与Agent Skill集成的资源,该数据集在自动化创意工作流和图像生成提示工程中具有重要影响力,推动了视觉提示的标准化与可复现性研究。
当前挑战
该数据集面临的挑战体现在多个层面。首先,在领域问题层面,它解决的是视觉提示生成与检索中的语义歧义问题,即如何确保用户输入的模糊意图(如'复古城市旅行海报')能够被准确映射到匹配的图像风格与内容上,这要求数据集具备高度结构化的标签体系。其次,在构建过程中,数据集面临数据来源的多样性与版权合规性挑战,需通过独立的DATA_LICENSE.md界定第三方内容边界。此外,本地化部署要求SQLite数据库(约80 MB)与镜像包(约4.3 GB)通过GitHub Releases分发,而非Git LFS,这增加了资产获取与版本同步的复杂性。最后,数据集刻意排除标注过程记录、模型配置等元数据,以保持生产环境的精简,但也限制了完全复现与扩展分析的可能性。
常用场景
经典使用场景
在视觉生成与多模态检索领域,Open Image Prompts 数据集被广泛用于构建高质量、可追溯的提示词-图像对照库。研究者通过其收录的逾1.4万条源提示词、2.5万余张图像及近30万条双语翻译,系统性地训练和评估文本到图像生成模型在概念覆盖、风格契合与语义对齐方面的表现。该数据集提供的封闭式视觉标签体系(涵盖185个视觉概念)与FTS检索索引,使得在无需额外模型推理的前提下,即可开展基于意图的精准图像回溯实验,成为评测生成式AI提示词工程效果的标准基准之一。
实际应用
在实际产业应用中,该数据集主要服务于AI绘画工具、广告创意自动生成及内容审核系统等场景。设计团队可借助其内置的“img-gen-taste”技能,将模糊的创作简报快速转化为清晰的艺术方向指示;而“img-gen-prompts”技能则允许运营人员通过自然语言意图检索历史优质图库,为电商产品图、社交媒体海报等素材生产提供直接参考。其本地优先、离线可用的部署特性,更使得隐私敏感行业(如医疗、金融)能够在断网环境下安全复用该资源,大幅降低了商业级视觉内容生产的试错成本与迭代周期。
衍生相关工作
基于Open Image Prompts衍生出的代表性工作包括:围绕提示词工程自动化的“img-gen-taste”与“img-gen-prompts”两项可安装Agent技能,它们分别实现了从粗略需求到艺术方向的转化以及可追溯的提示词-图像参考检索;检索回归测试集(含72组双语查询及人工审查的相关引用)构成了评测提示词检索效果的标准化工具;此外,研究者利用其公开的标签体系与双语翻译数据,开发了跨语言视觉概念映射算法,并在此基础上构建了支持多轮语义细化的交互式图像生成流水线。这些工作共同拓展了数据集在自动化创意生产与细粒度视觉理解交叉方向的应用边界。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务