登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Srishy/Clinton_text_to_sql_3000
Srishy/Clinton_text_to_sql_3000
收藏
Hugging Face
2023-12-07 更新
2024-03-04 收录
文本到SQL
数据链接:
https://hf-mirror.com/datasets/Srishy/Clinton_text_to_sql_3000
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- pretty_name: text_2_sql size_categories: - 1K<n<10K ---
应用场景:
提供机构:
Srishy
原始信息汇总
数据集概述
数据集名称
名称
: text_2_sql
数据集大小
大小范围
: 1K<n<10K
相关数据集
aherntech/sparc
文本到SQL
跨语言语义分析
SParC是一个上下文依赖的多轮版本Spider任务1.0数据集,专门用于文本到SQL问题的聊天机器人测试集。该数据集包含4,298个连贯的问题序列(超过12,000个单独的问题,每个问题都标注了SQL查询),这些数据来源于用户与138个领域的200个复杂数据库的受控交互。SParC展示了复杂的上下文依赖、更大的语义多样性,并且由于其跨领域性质和在测试时未见过的数据库,需要泛化到未见过的领域。该数
Hugging Face
2024-03-16 更新
75
0
AmbiQT
文本到SQL
模糊评估
AmbiQT是由印度理工学院孟买分校开发的创新基准数据集,包含超过3000个示例,旨在评估文本到SQL转换模型在模糊性情况下的性能。每个文本查询可以解释为两个合理的SQL语句,由于词汇和/或结构模糊性。数据集通过结合ChatGPT基于同义词生成和规则基础扰动来生成,旨在解决现实数据库中由于重叠的架构名称和多个混淆的关系路径而经常涉及的模糊性问题。AmbiQT的应用领域包括数据库查询的自然语言接口,
arXiv
2023-10-21 更新
22
0
Marchanjo/spider-fr
文本到SQL
多语言处理
mRAT-SQL和mRAT-SQL+GAP是两个将自然语言翻译成SQL查询的项目。mRAT-SQL通过数据库模式剪枝技术处理长文本序列,并使用多语言方法在英语、葡萄牙语、西班牙语和法语上进行了微调。mRAT-SQL+GAP专注于葡萄牙语的文本到SQL翻译,并使用了多语言BART模型。两个项目都基于Spider数据集,并提供了源代码、评估和检查点。
Hugging Face
2024-01-16 更新
10
0
ramachetan22/sql-create-context-v2
文本到SQL
数据处理
`sql-create-context-v2`数据集是对原始WikiSQL和Spider数据集的增强,专注于文本到SQL任务,特别强调减少列名和表名的幻觉。此版本引入了JSONL格式以提高数据处理和迭代的效率,并采用结构化方法表示数据集条目中的SQL查询。关键增强包括数据集格式转换为JSON Lines (JSONL)和结构化查询表示。样本条目展示了数据集的结构,包括问题、上下文和SQL查询答案。
Hugging Face
2024-02-25 更新
29
0
DeepIQInc/bird_test_real_prompt_set
文本到SQL
自然语言处理
--- configs: - config_name: default data_files: - split: test path: data/test-* dataset_info: features: - name: question dtype: string - name: sql dtype: string - name: db_id
Hugging Face
2024-05-07 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广