登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
DeL-TaiseiOzaki/Tengentoppa-sft-seed-elyza-reasoning-QwQ
DeL-TaiseiOzaki/Tengentoppa-sft-seed-elyza-reasoning-QwQ
收藏
Hugging Face
2024-12-16 更新
2024-12-21 收录
数据链接:
https://hf-mirror.com/datasets/DeL-TaiseiOzaki/Tengentoppa-sft-seed-elyza-reasoning-QwQ
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-sa-4.0 ---
许可证:知识共享署名-相同方式共享4.0协议(CC BY-SA 4.0)
应用场景:
提供机构:
DeL-TaiseiOzaki
相关数据集
DeL-TaiseiOzaki/Tengentoppa-sft-base-v1.0
自然语言处理
机器学习
该数据集是一个由12个日语instruction-following数据集整合而成的监督学习用数据集。它包含对话形式的数据、问答、推理任务等多种数据来源,主要用于模型的微调。数据格式为JSON,每个数据点包含instruction、input和output三个字段。
Hugging Face
2024-11-27 更新
14
0
DeL-TaiseiOzaki/Tengentoppa-sft-qwen2.5-32b-reasoning-100k
自然语言处理
对话系统
该数据集是通过大規模言語モデル(Qwen2.5-32B-instruct)自动生成的日本語指示与响应集合,包含125,000个样本,主要用于日本語指示付与型タスク的学習和評価。数据集采用JSONL格式,每个样本包含指示文、回答手順、初期回答和精査後回答。数据集生成过程中使用了多種ペルソナ和Chain-of-Thought (CoT) 技术以提高生成多样性。
Hugging Face
2024-11-03 更新
13
0
DeL-TaiseiOzaki/Tengentoppa-sft-v4.0
自然语言处理
日语数据集
Tengentoppa Corpus for SFT是一个由17个日语指令跟随数据集合并而成的教師あり学習(SFT)用大规模数据集,包含213,265个指令-响应对,适用于多种任务和对话形式。
Hugging Face
2025-10-04 更新
9
0
DeL-TaiseiOzaki/Tengentoppa-sft-v2.0
自然语言处理
机器学习
这是一个通过整合14个日语instruction-following数据集创建的监督学习用数据集。数据集包含对话形式的数据、问答和推理任务等多种数据源。主要收集了需要高级推理能力的任务,如mt-bench和elyza-task。数据集的格式为JSON,每个数据点的结构包括instruction、input和output字段。数据集的转换代码在GitHub上公开。数据集包含多个子数据集,每个子数据集
Hugging Face
2024-11-26 更新
13
0
DeL-TaiseiOzaki/Tengentoppa-sft-reasoning-llama-nemotron-70b-100k
--- license: llama3.1 task_categories: - text-generation language: - ja --- # Dataset Card for Dataset Name This dataset card aims to be a base templ
Hugging Face
2024-10-22 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广