prompt-compression-v2
收藏资源简介:
该数据集是一个用于提示词压缩任务的配对文本数据集,包含110个训练样本。每个样本由唯一标识符(id)、原始提示词(original_prompt)和压缩后提示词(compressed_prompt)三个字段组成。数据集旨在支持提示词优化、文本精简或效率提升等自然语言处理任务,通过对比原始与压缩版本,可用于模型训练、评估提示词压缩算法或研究文本简化技术。数据以文本字符串格式存储,适用于文本生成、改写或压缩相关的研究与应用。
This dataset contains paired text data for prompt compression tasks, consisting of 110 training samples. Each sample includes three fields: a unique identifier (id), the original prompt (original_prompt), and the corresponding compressed prompt (compressed_prompt). The dataset is designed to provide training resources for natural language processing tasks such as prompt optimization, text simplification, or efficiency improvement. By comparing the original and compressed versions, it can be used for model training, evaluating prompt compression algorithms, or researching text simplification techniques. The data is stored as text strings and is suitable for research and applications related to text generation, rewriting, or compression.
- 数据集名称:prompt-compression-v2
- 数据集提供者:gaurav-sharma56
- 数据集规模:
- 总下载大小:2,260,320 字节
- 数据集大小:4,172,725 字节
- 数据划分:仅包含训练集(train),共 980 个样本
- 数据特征:
id(整数型):样本唯一标识original_prompt(字符串型):原始提示文本compressed_prompt(字符串型):压缩后的提示文本
- 配置文件:默认配置(default),训练数据路径为
data/train-*




