jaeyong2/Id-emb-PreView
收藏官方服务:
资源简介:
该数据集包含三个特征:context、Title和Fake Title,分为train和test两个部分,分别包含152490和16944个样本。数据集来源于indonesian-nlp/wikipedia-id-20231101,并使用Qwen/Qwen2-72B-Instruct模型生成答案。
This dataset is sourced from [indonesian-nlp/wikipedia-id-20231101](https://huggingface.co/datasets/indonesian-nlp/wikipedia-id-20231101) and uses the [Qwen/Qwen2-72B-Instruct](https://huggingface.co/Qwen/Qwen2.5-72B-Instruct) model to generate answers. The dataset includes three features: context, Title, and Fake Title, along with two data splits: train and test.
提供机构:
jaeyong2


