ShareGPT-4o-Image
收藏资源简介:
ShareGPT-4o-Image是一个大规模、高质量的数据集,包含92K个样本,由GPT-4o的图像生成能力生成,包括45K个文本到图像和46K个文本和图像到图像的示例。它旨在支持开发与GPT-4o在图像生成方面的优势对齐的开放多模态模型。
ShareGPT-4o-Image is a large-scale, high-quality dataset containing 92K samples generated by GPT-4o's image generation capabilities, including 45K text-to-image examples and 46K text-and-image-to-image examples. It is designed to support the development of open multimodal models aligned with GPT-4o's strengths in image generation.
ShareGPT-4o-Image 数据集概述
📌 数据集简介
- 名称: ShareGPT-4o-Image
- 目标: 支持开发与GPT-4o图像生成能力对齐的多模态模型
- 规模: 92K样本(45K文本生成图像 + 46K文本和图像生成图像)
- 生成来源: GPT-4o的图像生成能力
📊 数据组成
| 数据类型 | 样本数量 |
|---|---|
| 文本生成图像 (Text-to-Image) | 45,717 |
| 文本和图像生成图像 (Text-and-Image-to-Image) | 46,539 |
| 总计 | 92,256 |
🛠️ 相关模型
- 模型名称: Janus-4o
- 基础模型: Janus-Pro-7B
- 能力:
- 文本生成图像
- 文本和图像生成图像
- Hugging Face地址: FreedomIntelligence/Janus-4o-7B
📜 引用信息
bibtex @misc{chen2025sharegpt4oimg, title={ShareGPT-4o-Image: Aligning Multimodal Models with GPT-4o-Level Image Generation}, author={Junying Chen and Zhenyang Cai and Pengcheng Chen and Shunian Chen and Ke Ji and Xidong Wang and Yunjin Yang and Benyou Wang}, year={2025}, eprint={2506.18095}, archivePrefix={arXiv}, primaryClass={cs.CV}, url={https://arxiv.org/abs/2506.18095}, }
🔗 资源链接
- 论文地址: arXiv:2506.18095
- 数据集地址: Hugging Face - ShareGPT-4o-Image




