数据链接:
官方服务:
资源简介:
Sample textual inputs to a database system.
应用场景:
创建时间:
2021-03-06
相关数据集
NL2SQL-BUGs
NL2SQL-BUGs是一个专门用于检测和分类自然语言到SQL(NL2SQL)翻译中语义错误的基准。该基准旨在支持语义错误检测的研究,这是任何后续错误纠正的前提。数据集包含2,018个实例,其中1,019个是正确的示例,999个是语义错误的示例。每个错误示例都详细注释了特定的错误类型。
github2025-03-19 更新480
DanielRegaladoCardoso/text-to-sql-mix-v2
--- language: - en - zh license: apache-2.0 task_categories: - text-generation task_ids: - language-modeling tags: - sql - text-to-sql - code-generation - instruction-tuning - databa
Hugging Face2026-04-14 更新120
hoadm/vibird
ViBIRD是BIRD文本到SQL基准的越南语翻译版本,包含问题和证据字段的越南语翻译。数据集分为训练集(9,428条)和开发集(1,534条),总计10,962条。每个条目包含唯一标识符、数据库标识符、原始英文问题和证据、SQL查询、SQL复杂度类、难度级别、越南语翻译问题和证据以及翻译方法。翻译方法包括人工翻译(1,415条)、GPT少量样本翻译(2,357条)和基于Qwen2.5-7B的双字
Hugging Face2026-04-22 更新60
PARROT
PARROT是一个用于评估跨系统SQL翻译的实用且真实的基准数据集,它由来自38个开源基准和真实世界商业服务的598个翻译对组成,旨在挑战特定系统的SQL理解。它还提供了多个基准变体,包括PARROT-Diverse(包含28,003个翻译,用于广泛的语法测试)和PARROT-Simple(包含5,306个代表性样本,用于集中的压力测试),涵盖了22个生产级数据库系统。该数据集旨在促进未来研究,通
arXiv2025-09-27 更新340
ahmedheakl/synthetic-arabic-sql
--- license: mit dataset_info: features: - name: sql dtype: string - name: question dtype: string - name: schema dtype: string - name: translation dtype: string splits: -
Hugging Face2024-04-24 更新80



