text_rendering
收藏资源简介:
text_rendering 数据集是一个用于文本渲染任务的数据集,采用 MIT 许可证。数据集包含 111 个示例,数据格式为 p-image。数据来源于 `/Users/davidberenstein/Documents/programming/pruna/dataset-generator/training/text-rendering.zip`。数据集适用于使用 p-image-trainer(Replicate)进行训练,具体训练模式和模式文件可参考 `config.yml` 和 `TRAINING_PLAN.md`。数据集可以通过 `generate.py` 脚本从 dataset-generator 仓库重新生成。加载数据集时可以使用 HuggingFace 的 `load_dataset` 函数,指定仓库名称为 'davidberenstein1957/text_rendering' 并设置 `trust_remote_code=True`。
text_rendering 数据集是面向文本渲染任务的专用数据集,采用 MIT 许可证。该数据集共收录111条示例样本,数据格式为 p-image。其数据源路径为 `/Users/davidberenstein/Documents/programming/pruna/dataset-generator/training/text-rendering.zip`。本数据集适配基于 p-image-trainer(Replicate)的训练流程,具体训练模式、配置文件与训练说明可分别参考 `config.yml` 与 `TRAINING_PLAN.md`。用户可通过 `generate.py` 脚本从 dataset-generator 仓库重新生成该数据集。加载该数据集可借助 HuggingFace 提供的 `load_dataset` 函数,指定仓库名称为 `davidberenstein1957/text_rendering` 并将 `trust_remote_code` 参数设置为 `True`。
text_rendering 数据集概述
基本信息
- 许可证: MIT
- 触发词:
sks_textrender - 示例数量: 111
- 格式: p-image
- 数据源文件:
/Users/davidberenstein/Documents/programming/pruna/dataset-generator/training/text-rendering.zip
格式与训练
- 训练器: p-image-trainer
- 使用说明: 使用
input.zip配合 p-image-trainer(Replicate)进行训练。详细信息请参阅本目录中的TRAINING_PLAN.md文件。 - 模式定义: 具体模式定义请参阅本仓库中的
config.yml和TRAINING_PLAN.md文件。
数据加载
可通过以下代码加载数据集: python from datasets import load_dataset ds = load_dataset("davidberenstein1957/text_rendering", trust_remote_code=True)
数据复现
本仓库中的 generate.py 文件记录了如何从 dataset-generator 仓库重新生成此数据集。




