数据链接:
官方服务:
资源简介:
FAQs of Virtual University of Pakistan converted into a json file.
应用场景:
创建时间:
2026-01-18
相关数据集
InstructGpt-educational
LuminaSFT 是一个专为小型语言模型(SLMs)设计的合成监督微调(SFT)数据集集合,通过教师引导的数据再生和任务特定的合成数据生成方法创建。该集合包含五个子数据集:UltraChat200K-regenerated(通用指令数据再生)、InstructGpt-NaturalQa(事实问答)、InstructGpt-TriviaQa(事实问答)、Cot-Drop(阅读理解)和Instruc
Hugging Face2026-02-11 更新250
leoleoasd/learningq_ted_ed
--- license: unknown configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* datas
Hugging Face2023-11-09 更新100
c-e-r-u/CS-552-NounNinjas-FAISS-RAG
该数据集包含一个FAISS索引,用于问答任务中的检索增强生成(Retrieval Augmented Generation)。该索引是通过使用BAAI/bge-base-en-v1.5模型在TutorChat数据集和一些书籍的嵌入生成的。数据由1000个字符的块组成,每个块之间有150个字符的重叠。
Hugging Face2024-06-14 更新50
SeePhys
该数据集包含问题和答案对,以及与问题相关的科目、图片路径、答案的精确度(sig_figs)、难度等级(level)、语言(language)、索引(index)、推理过程(reasoning)、图片类别(img_category)、视觉相关性(vision_relevance)、图片标题(caption)和图片本身(image)。数据集分为训练集,共有2000个示例,总大小为479462980字节
Hugging Face2025-05-19 更新110
LifelongAlignment/aifgen-short-piecewise
这是一个为终身强化学习适应性训练而创建的连续数据集,包含两个任务:数学、社会科学、物理或化学的非平凡问题,一个是提示性回答任务,另一个是直接回答任务。数据集由Mila - Quebec AI Institute和Complex Data Lab团队使用AIF-Gen框架生成,适用于大型语言模型的微调。
Hugging Face2025-05-16 更新90



