taesiri/fsmbench_what_is_the_next_state
收藏资源简介:
--- dataset_info: features: - name: query_id dtype: string - name: fsm_id dtype: string - name: fsm_json dtype: string - name: difficulty_level dtype: int64 - name: transition_matrix dtype: string - name: query dtype: string - name: answer dtype: string splits: - name: validation num_bytes: 350355112 num_examples: 100000 download_size: 73146244 dataset_size: 350355112 configs: - config_name: default data_files: - split: validation path: data/validation-* ---
数据集信息: 特征: - 名称:查询ID(query_id),数据类型:字符串 - 名称:有限状态机ID(fsm_id,FSM ID),数据类型:字符串 - 名称:有限状态机JSON(fsm_json,FSM JSON),数据类型:字符串 - 名称:难度等级(difficulty_level),数据类型:64位整数 - 名称:转移矩阵(transition_matrix),数据类型:字符串 - 名称:查询(query),数据类型:字符串 - 名称:答案(answer),数据类型:字符串 数据集划分: - 划分名称:验证集,字节数:350355112,样本总数:100000 下载大小:73146244 数据集总大小:350355112 配置项: - 配置名称:默认配置(default),数据文件: - 划分:验证集,路径:data/validation-*
数据集信息
特征
- query_id: 数据类型为字符串。
- fsm_id: 数据类型为字符串。
- fsm_json: 数据类型为字符串。
- difficulty_level: 数据类型为整数(int64)。
- transition_matrix: 数据类型为字符串。
- query: 数据类型为字符串。
- answer: 数据类型为字符串。
数据分割
- validation: 包含100000个样本,总字节数为350355112。
数据集大小
- 下载大小: 73146244字节。
- 数据集大小: 350355112字节。
配置
- default: 包含验证数据文件,路径为
data/validation-*。




