Harshkmr/omniscribe_eval_results
收藏资源简介:
--- dataset_info: - config_name: base features: - name: source dtype: string - name: language dtype: string - name: reference dtype: string - name: system_prompt dtype: string - name: audio_duration_s dtype: float64 - name: audio_clipped dtype: bool - name: prediction_base dtype: string splits: - name: predictions_base num_bytes: 3643172 num_examples: 4002 download_size: 875897 dataset_size: 3643172 - config_name: lora features: - name: source dtype: string - name: language dtype: string - name: reference dtype: string - name: system_prompt dtype: string - name: audio_duration_s dtype: float64 - name: audio_clipped dtype: bool - name: prediction_lora dtype: string splits: - name: predictions_lora num_bytes: 3325254 num_examples: 4002 download_size: 823562 dataset_size: 3325254 configs: - config_name: base data_files: - split: predictions_base path: base/predictions_base-* - config_name: lora data_files: - split: predictions_lora path: lora/predictions_lora-* ---
数据集信息: - 配置名称:base 特征字段: - 字段名:来源(source),数据类型:字符串 - 字段名:语言(language),数据类型:字符串 - 字段名:参考文本(reference),数据类型:字符串 - 字段名:系统提示词(system_prompt),数据类型:字符串 - 字段名:音频时长(audio_duration_s),数据类型:64位浮点型,单位为秒 - 字段名:音频是否裁剪(audio_clipped),数据类型:布尔型 - 字段名:基础模型预测结果(prediction_base),数据类型:字符串 数据划分: - 划分名称:predictions_base,字节数:3643172,样本数量:4002 下载大小:875897,数据集存储大小:3643172 - 配置名称:低秩自适应(Low-Rank Adaptation,LoRA) 特征字段: - 字段名:来源(source),数据类型:字符串 - 字段名:语言(language),数据类型:字符串 - 字段名:参考文本(reference),数据类型:字符串 - 字段名:系统提示词(system_prompt),数据类型:字符串 - 字段名:音频时长(audio_duration_s),数据类型:64位浮点型,单位为秒 - 字段名:音频是否裁剪(audio_clipped),数据类型:布尔型 - 字段名:LoRA模型预测结果(prediction_lora),数据类型:字符串 数据划分: - 划分名称:predictions_lora,字节数:3325254,样本数量:4002 下载大小:823562,数据集存储大小:3325254 配置项: - 配置名称:base 数据文件: - 数据划分:predictions_base,文件路径:base/predictions_base-* - 配置名称:低秩自适应(Low-Rank Adaptation,LoRA) 数据文件: - 数据划分:predictions_lora,文件路径:lora/predictions_lora-*




