登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
tianchicai/Anthropic_HH_GPT4
tianchicai/Anthropic_HH_GPT4
收藏
Hugging Face
2023-09-29 更新
2024-03-04 收录
AI对齐
语言模型评估
数据链接:
https://hf-mirror.com/datasets/tianchicai/Anthropic_HH_GPT4
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
许可证:Apache-2.0
应用场景:
提供机构:
tianchicai
原始信息汇总
数据集许可证
许可证类型:Apache 2.0
搜集汇总
数据集介绍
以上内容由遇见数据集搜集并总结生成
相关数据集
HAERAE-HUB/HAE_RAE_BENCH_1.1
文化理解
语言模型评估
HAE_RAE_BENCH 1.1是一个旨在开发一系列评估任务的项目,这些任务用于测试模型对韩国文化和语境细微差别的理解。目前,它包括13个不同的任务,总计4900个实例。数据集包含多种选择题,涉及韩国标准术语、外来词、罕见词汇、文化知识、历史、日期理解、谚语去噪、歌词去噪、阅读理解、法律、地理和社会研究等多个领域。
Hugging Face
2024-03-30 更新
21
0
open-llm-leaderboard/details_ParasiticRogue__Merged-RP-Stew-V2-34B
语言模型评估
多领域知识
该数据集是在模型 ParasiticRogue/Merged-RP-Stew-V2-34B 在 Open LLM Leaderboard 上的评估运行期间自动创建的。数据集由 63 个配置组成,每个配置对应一个评估任务。数据集是从 1 次运行中生成的,每次运行在每个配置中表示为特定的分割,使用运行的时间戳命名。train 分割始终指向最新的结果。一个额外的配置 results 存储了所有运行的聚合
Hugging Face
2024-04-15 更新
17
0
open-llm-leaderboard/details_jeiku__Average_Normie_l3_v1_8B
语言模型评估
多领域知识
该数据集是在模型jeiku/Average_Normie_l3_v1_8B的评估运行期间自动创建的,用于在Open LLM Leaderboard上进行评估。数据集包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行都可以在特定配置中找到,并以运行的时间戳命名。train分割始终指向最新的结果。此外,results配置存储了所有运行的聚合结果,并用于计算和显示Open LLM
Hugging Face
2024-04-24 更新
14
0
APEACH
仇恨言论检测
语言模型评估
APEACH数据集是由Kakao Corp.等机构合作创建的,专注于韩国仇恨言论检测。该数据集包含约3770条实例,涵盖了多样化的主题和句子长度,旨在通过用户生成的内容减少与预训练语料库的词汇重叠,从而更准确地评估模型性能。创建过程中,采用了匿名付费工作者生成有毒表达的方式,并通过任务管理器进行后标记,确保数据质量。APEACH数据集的应用领域主要集中在评估预训练语言模型在仇恨言论检测中的性能,特
arXiv
2022-10-26 更新
20
0
dipudl/hc3-and-gpt-wiki-intro-with-perplexity-and-128-window
自然语言处理
语言模型评估
--- dataset_info: features: - name: prompt dtype: string - name: text dtype: string - name: source dtype: string - name: label dtype: int64 - name: perplexity dtype: fl
Hugging Face
2024-02-08 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广