登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Supplemental Table S1. ChatGPT’s responses to CU questions
Supplemental Table S1. ChatGPT’s responses to CU questions
收藏
Mendeley Data
2026-04-18 收录
医学问答评估
语言模型测试
数据链接:
https://data.mendeley.com/datasets/jrcbt5yb85
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Supplemental Table S1. ChatGPT’s responses to CU questions
应用场景:
创建时间:
2024-04-22
相关数据集
LMentry
语言模型测试
基准评估
LMentry是一个专为大型语言模型设计的基准测试数据集,由特拉维夫大学创建。该数据集包含25个简单的语言任务,旨在快速评估模型的能力和鲁棒性。这些任务对人类来说非常简单,如包含特定单词的句子写作或识别列表中属于特定类别的单词。数据集创建过程中,每个任务都遵循了特定的指导原则,确保任务的简单性和可解释性。LMentry的应用领域主要集中在零样本评估,旨在解决大型语言模型在简单任务上的表现问题,以及
arXiv
2022-12-19 更新
109
0
生成式人工智能(大语言模型)服务备案评估测试题
人工智能评估
语言模型测试
测试题的来源主要由公司自行采集和构建,针对业务场景与风险图谱进行系统性设计,涵盖数据安全、内容合规、伦理对齐等多个维度。同时,公司会结合公开基准、行业最佳实践及真实用户反馈,持续扩展和更新测试集,以全面提升评估的覆盖面和实效性。
安徽省数据知识产权登记平台
2025-09-01 更新
27
0
Detsutut/medmcqa-ita-filtered
医学问答评估
意大利语医学教育
该数据集是一个意大利语的多项选择题数据集,包含问题、选项、正确答案、解释、科目名称和主题名称等特征。数据集分为训练集、验证集和测试集,分别包含160209、2206和6150个样本。下载大小为89634015字节,数据集大小为128809523.82255061字节。
Hugging Face
2024-07-03 更新
11
0
Kaggle_LLM_Deberta
自然语言处理
语言模型测试
Deberta for 2023 Kaggle LLM competition
kaggle
2023-08-19 更新
30
0
NYCU-312555007/ZH-TW_Reading_Comprehension_Test_for_LLMs
阅读理解
语言模型测试
--- configs: - config_name: train data_files: "train.json" - config_name: test data_files: "test.json" ---
Hugging Face
2024-05-15 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广