登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
LLM Fine-Tuning Dataset: Instruction-Response
LLM Fine-Tuning Dataset: Instruction-Response
收藏
kaggle
2026-01-22 更新
2026-02-14 收录
语言模型
微调
数据链接:
https://www.kaggle.com/datasets/samratabduljalil/llm-fine-tuning-dataset-instruction-response
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Supervised Instruction Dataset for Fine-Tuning Language Models
用于语言模型微调的监督指令数据集
应用场景:
创建时间:
2026-01-22
相关数据集
Sangeetha/Kaggle-LLM-Science-Exam
科学考试
语言模型
LLM Science Exam Kaggle Competition数据集是一个由大型语言模型生成的科学问题数据集。数据集包含问题文本、多个选项以及由生成模型定义的最正确答案。数据集的语言包括英语、德语、意大利语、西班牙语、法语、葡萄牙语、印度尼西亚语、波兰语、罗马尼亚语、索马里语、加泰罗尼亚语、丹麦语、斯瓦希里语、匈牙利语、挪威语、荷兰语、爱沙尼亚语、南非荷兰语、克罗地亚语、拉脱维亚语和斯洛文
Hugging Face
2023-08-08 更新
21
0
Hybrid Human-LLM Corpus
语言模型
因果运动构造
本研究开发了一个结合人类和大型语言模型(LLM)的混合语料库,专注于罕见的语言现象——因果运动构造(CMC)。数据集包含765个经过手动验证的CMC实例,用于评估GPT、Gemini、Llama2和Mistral模型对CMC的理解。此外,还通过自动扩展创建了一个包含127,955个高可能性CMC实例的半自动数据集。这些数据集的构建旨在解决大型语言模型在处理复杂语言结构时的性能问题,特别是在非典型C
arXiv
2024-03-12 更新
17
0
tellarin-ai/llm-japanese-dataset-vanilla-aya-format
语言模型
数据调优
该数据集是从其原始v1.0.0格式转换而来,并在此以相同的CC-BY-SA 4.0许可证和条件下发布。它包含用于LLM构建/调整的日语指令类数据。数据集仅包含一个train分割,约有2.46M行数据。格式转换的细节包括如何将原始数据集中的instruction和input列合并,并在特定情况下添加前缀句子。转换后的数据集仅使用Aya格式指定的两列:inputs和targets。
Hugging Face
2024-01-31 更新
15
0
rewoo/sotu_qa_2023
政治问答
语言模型
这是一个关于2023年国情咨文的问答基准数据集,特别适用于工具增强的语言模型(LMs)或增强语言模型(ALMs)来测试模型在回答私有文档问题上的能力。
Hugging Face
2023-05-22 更新
20
0
fine-tuned/jinaai_jina-embeddings-v2-base-es-6262024-yjwm-webapp
语言模型
西班牙文化
数据集“当代西班牙语言和文化”是一个生成的数据集,旨在支持开发特定领域的嵌入模型以用于检索任务。
Hugging Face
2024-06-26 更新
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广