neulab/odex
收藏官方服务:
资源简介:
ODEX是一个开放领域的基于执行的自然语言到代码生成的数据基准。它包含945个样本和1,707个人工编写的测试用例,涵盖了四种不同的自然语言的意图——439个英语,90个西班牙语,164个日语和252个俄语。
ODEX is an open-domain execution-based natural language-to-code generation benchmark dataset. It contains 945 samples and 1,707 manually-written test cases, with the natural language intents of the samples covering four distinct languages: 439 in English, 90 in Spanish, 164 in Japanese, and 252 in Russian.
提供机构:
neulab原始信息汇总
数据集概述
基本信息
- 名称: ODEX
- 类型: 开放域基于执行的NL-to-Code生成数据基准
- 样本数量: 945个样本
- 测试案例总数: 1,707个人类编写的测试案例
语言覆盖
- 英语: 439个案例
- 西班牙语: 90个案例
- 日语: 164个案例
- 俄语: 252个案例
使用方法
- 加载数据集: 通过指定语言子集(默认加载英语子集) python from datasets import load_dataset ds = load_dataset("neulab/odex", "ja", split="test")
许可协议
- 许可证: CC-BY-SA-4.0
任务类别
- 文本到文本生成
- 文本生成
大小分类
- 数据集大小: 小于1K



