Spider是由耶鲁大学计算机科学系创建的大规模、复杂且跨领域的语义解析和文本到SQL数据集。该数据集包含10,181个自然语言问题和5,693个独特的复杂SQL查询,涉及200个数据库覆盖138个不同领域。作为首个复杂跨域文本到SQL基准数据集,Spider旨在测试模型对新SQL查询和新数据库模式的泛化能力,广泛应用于自然语言处理、数据库查询等领域。