INSAIT-Institute/SaberMath-documents
收藏资源简介:
该数据集是一个包含问题解决相关信息的集合,用于机器学习任务。数据集包括以下字段:唯一标识符id、解决方案solution、答案answer、元数据metadata(其中包含competition竞赛信息、dataset数据集来源、posts帖子列表,帖子有附件、内容、发布时间、用户信息等)、问题描述problem、标签tags、想法idea、原始索引original_index和领域domains。数据集分为一个训练集,共71117个样本,总大小约449MB,可能来源于竞赛或论坛讨论,用于训练模型处理问题解决、答案生成或内容分析任务。
This dataset is a collection of problem-solving related information for machine learning tasks. It includes fields such as id (unique identifier), solution, answer, metadata (containing competition, dataset, posts with attachments, content, timestamps, user details, etc.), problem description, tags, idea, original_index, and domains. The dataset consists of a single train split with 71,117 examples and a total size of approximately 449 MB, likely sourced from competitions or forum discussions, intended for training models on tasks like problem-solving, answer generation, or content analysis.




