SurGE (Survey Generation Evaluation)
收藏资源简介:
SurGE数据集是计算机科学领域科学综述生成的首个全面基准,包括专家撰写的基准综述和大型学术论文语料库。数据集包含205篇经过严格验证的综述论文和108万篇计算机科学论文的元数据,作为检索池。SurGE旨在促进可重复的研究,并为科学综述生成提供一个标准的评估框架。
The SurGE dataset is the first comprehensive benchmark for scientific review generation in the field of computer science, comprising expert-authored benchmark reviews and a large-scale academic paper corpus. It contains 205 rigorously validated review papers and the metadata of 1.08 million computer science papers, serving as the retrieval pool. The SurGE dataset aims to facilitate reproducible research and provide a standardized evaluation framework for scientific review generation.
SurGE 数据集概述
数据集简介
SurGE 是一个面向计算机科学领域的端到端科学综述生成基准和数据集。该数据集为自动化综述生成系统评估提供了全面资源,包括大规模数据集和全自动评估框架。
核心组成
1. 真实综述数据
- 数据量:包含 205 篇精心策划的真实综述
- 存储位置:
data/surveys.json - 数据字段:
authors:研究人员列表survey_title:综述标题year:发表年份date:精确发表时间戳category:arXiv 学科分类abstract:综述摘要structure:综述组织的层次结构表示survey_id:唯一标识符all_cites:综述中引用的文档 ID 列表Bertopic_CD:使用 BERTopic 计算的多样性度量
2. 文献知识库
- 数据量:1,086,992 篇学术论文
- 存储位置:
data/corpus.json - 数据字段:
Title:论文标题Authors:研究人员列表Year:发表年份Date:论文发布时间戳Abstract:论文摘要Category:arXiv 学科分类doc_id:唯一标识符
3. 辅助映射
- 存储位置:
data/queries.json - 数据字段:
original_id:查询来源章节的标识符query_id:查询 IDcontent:章节内容prefix_titles:章节/小节/段落的层次标题列表prefix_titles_query:相关检索问题cites:章节中引用的文档 ID 列表cite_extract_rate:提取引用数与原始引用数的比率origin_cites_number:章节中原有的总引用数
数据集获取
完整数据集可从 https://drive.google.com/drive/folders/1ZZPeZvjexFcCmgFqxftKeCPn1vYeBR0Q?usp=drive_link 下载
评估指标
- ROUGE-BLEU
- SH-Recall
- Structure_Quality (LLM_as_judge)
- Coverage
- Relevance-Paper
- Relevance-Section
- Relevance-Sentence
- Logic
许可证
MIT 许可证




