Madras1/rag-qa-fulltext-ptbr
收藏官方服务:
资源简介:
一个大规模的巴西葡萄牙语RAG风格问答对数据集,包含基于证据的文本片段,使用Mistral模型从`Madras1/corpus-ptbr-v1`文档生成。每个答案都锚定在源文本的直接引用上,使得该数据集适用于训练和评估检索增强生成系统、抽取式问答模型以及葡萄牙语的阅读理解基准。
A large-scale dataset of Brazilian Portuguese RAG-style question-answer pairs with grounded evidence spans, generated from `Madras1/corpus-ptbr-v1` documents using Mistral models. Every answer is anchored to literal quotations from the source text, making this dataset suitable for training and evaluating retrieval-augmented generation systems, extractive QA models, and reading comprehension benchmarks in Portuguese.
提供机构:
Madras1


