遇见数据集

collinear-ai/TEMP-3f-hallucinations

收藏
Hugging Face2026-02-12 更新2026-04-05 收录
官方服务:

资源简介:

--- dataset_info: features: - name: sub_category dtype: string - name: title dtype: string - name: expected_behavior dtype: string - name: failure_modes list: string - name: constraints list: string - name: evaluation_focus dtype: string - name: tags list: string - name: generation_seed dtype: int64 - name: model_used dtype: string - name: generator_model dtype: string - name: token_count dtype: int64 - name: id dtype: string - name: conversations list: - name: content dtype: string - name: role dtype: string splits: - name: train num_bytes: 316505 num_examples: 90 download_size: 134163 dataset_size: 316505 configs: - config_name: default data_files: - split: train path: data/train-* ---

数据集信息(dataset_info): 特征字段: - 字段名:子类别(sub_category),数据类型:字符串(string) - 字段名:标题(title),数据类型:字符串(string) - 字段名:预期行为(expected_behavior),数据类型:字符串(string) - 字段名:故障模式(failure_modes),数据类型:字符串列表(list: string) - 字段名:约束条件(constraints),数据类型:字符串列表(list: string) - 字段名:评估重点(evaluation_focus),数据类型:字符串(string) - 字段名:标签(tags),数据类型:字符串列表(list: string) - 字段名:生成种子(generation_seed),数据类型:64位整数(int64) - 字段名:所用模型(model_used),数据类型:字符串(string) - 字段名:生成模型(generator_model),数据类型:字符串(string) - 字段名:Token 计数(token_count),数据类型:64位整数(int64) - 字段名:编号(id),数据类型:字符串(string) - 字段名:对话列表(conversations),数据类型:对象列表,列表内每个对象包含: - 字段名:内容(content),数据类型:字符串(string) - 字段名:角色(role),数据类型:字符串(string) 数据集划分(splits): - 划分名称:训练集(train),字节占用量:316505,样本数量:90 下载大小:134163,数据集总大小:316505 配置项(configs): - 配置名称:默认配置(default),数据文件配置: - 对应数据集划分:训练集(train),文件路径:data/train-*

提供机构:
collinear-ai
二维码
社区交流群
二维码
科研交流群
商业服务