登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Evaluation_Prompt_基于评估与提示的文档数据
Evaluation_Prompt_基于评估与提示的文档数据
收藏
海数据
2026-06-25 收录
提示工程
模型评估
数据链接:
https://haidatas.com/dataset/evaluation_prompt_jiyupingguyutishidewenda_fbb6a6ae
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
本数据集包含一份与“Evaluation and Prompt”相关的文档,未涉及训练测试、数据标签或原始处理等数据拆分,整体结构简单,仅包含一个文档文件。
应用场景:
提供机构:
公开数据
创建时间:
2026-01-29
相关数据集
dvilasuero/distillama3-prompts10k
积极心理学
模型评估
--- language: - en size_categories: n<1K dataset_info: - config_name: default features: - name: instruction dtype: string - name: generations sequence: string - name: generation_models
Hugging Face
2024-05-02 更新
14
0
open-llm-leaderboard-old/details_Steelskull__Aethora-7b-v1
模型评估
自然语言处理
--- pretty_name: Evaluation run of Steelskull/Aethora-7b-v1 dataset_summary: "Dataset automatically created during the evaluation run of model\ \ [Steelskull/Aethora-7b-v1](https://huggingface.co/St
Hugging Face
2024-04-02 更新
10
0
idk_eval
自然语言处理
模型评估
这是一个用于评估大型语言模型(LLMs)表达不确定性('我不知道')能力的多项选择题(MCQ)数据集。数据集合并了来自MMLU-Pro、LEXam和MedXpertQA的MCQ样本,支持可变选项长度(k=2-10)。数据集包含不同领域的题目,如法律和医学,并分为多个类别。每个类别有特定数量的题目,并生成了不同选项长度的变体。数据集包含英语和德语,使用CC-BY-4.0许可。
Hugging Face
2025-12-15 更新
2
0
open-llm-leaderboard-old/details_camel-ai__CAMEL-33B-Combined-Data
模型评估
自然语言处理
该数据集是在评估模型camel-ai/CAMEL-33B-Combined-Data时自动创建的。数据集由64个配置组成,每个配置对应一个评估任务。数据集从2次运行中创建,每次运行的结果作为特定配置中的一个分割,分割名称使用运行的时间戳。"train"分割始终指向最新的结果。此外,还有一个名为"results"的配置存储了所有运行的聚合结果,用于在Open LLM Leaderboard上计算和显
Hugging Face
2023-09-17 更新
12
0
arjun3103/haystack_faithfulness_evaluation
模型评估
自然语言处理
--- dataset_info: features: - name: questions dtype: string - name: contexts sequence: string - name: answers dtype: string - name: ans_type dtype: string - name: faithfuln
Hugging Face
2024-06-06 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广