登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TokenBender/sentence_retrieval_hindi_SFT
TokenBender/sentence_retrieval_hindi_SFT
收藏
Hugging Face
2024-01-28 更新
2024-03-04 收录
印地语句子检索
监督微调
数据链接:
https://hf-mirror.com/datasets/TokenBender/sentence_retrieval_hindi_SFT
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
TokenBender
原始信息汇总
数据集许可证
许可证类型:Apache 2.0
相关数据集
tulsatime37/Llama-Nemotron-Post-Training-Dataset
视觉语言模型
监督微调
该数据集是NVIDIA发布的Llama-Nemotron-Post-Training-Dataset-v1.1版本,旨在支持Llama-3.1-Nemotron-Ultra-253B-v1等模型的改进。数据集包含监督微调(SFT)和强化学习(RL)数据,覆盖数学、代码、科学、聊天、安全和指令跟随等多个领域。数据集中包含大量合成生成的数据,使用了多种模型进行响应生成。数据集的主要目的是用于训练和评估
Hugging Face
2025-12-13 更新
13
0
TokenBender/hindi_convo_high_quality
印地语对话
--- license: apache-2.0 ---
Hugging Face
2023-09-01 更新
9
0
nayan90k/slm-question-gen-sft-data
教育问题生成
监督微调
--- language: en tags: - question-generation - education license: mit --- # SLM Question Gen — SFT Dataset Supervised fine-tuning dataset for the `slm-question-gen` model. 171,360 train / 9,018
Hugging Face
2026-03-18 更新
7
0
TokenBender/telugu_high_quality_convo
泰卢固语
对话数据
--- license: apache-2.0 ---
Hugging Face
2023-09-01 更新
9
0
Weni/LLM_Base_2.0.3_SFT
语言模型
监督微调
该数据集包含五个特征:提示(prompt)、问题(question)、答案(answer)、上下文(context)和正确答案(correct_ans)。数据集仅包含一个训练集,共有39345个样本,总大小为73736965字节,下载大小为25677022字节。数据集的配置名为default,数据文件路径为data/train-*。
Hugging Face
2024-01-01 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广